Chargement de l'image...Kiro

Produit

  • À propos de Kiro
  • IDE
  • CLI
  • Web
  • Mobile
  • Crew
  • Tarification
  • Téléchargements

Pour

  • Entreprise
  • Startups
  • Étudiants

Communauté

  • Aperçu
  • Ambassadeurs
  • Discord
  • Événements
  • Powers
  • Boutique
  • Vitrine

Ressources

  • Docs
  • Blogue
  • Journal des modifications
  • FAQ
  • Signaler un bogue
  • Suggérer une idée
  • Soutien à la facturation

Réseaux sociaux

Conditions d'utilisation du siteLicencePolitique d'IA responsableMentions légalesPolitique de confidentialitéPréférences relatives aux témoins
Chargement de l'image...Kiro
  • Entreprise
  • Tarification
  • Docs
SE CONNECTERTÉLÉCHARGER
Chargement de l'image...Kiro

Pour commencer

InstallationAuthentificationVotre premier projet

Modèles

AperçuModèles disponiblesEffort de raisonnement

Fonctionnalités

Comment fonctionne Kiro
Specs
Steering
Hooks
MCP
Autorisations
Agents personnalisés
Agent Skills
Powers
Sessions cloudCompactionKiroignorePoints de contrôle et rewind
Outils intégrés
Portées de configuration

IDE 1.x

Nouveautés de la version 1.0
Configuration et premier lancement
Éditeur
Chat
Expérimental
DépannageRéférence 0.x

CLI

Nouveautés de la version 3.0
Configuration et première exécution
Interface utilisateur du terminal
Clavardage
Mode vocalMode sans interfaceACPAutocomplétion
Expérimental
Référence 2.x

Crew

Démarrage rapideInstallationFonctionnement 24/7
Chat
Agent Capabilities
Fonctionnalités
Interfaces
Applications
ConfigurationSécuritéDépannage

Web - Aperçu

Configuration et première exécutionIdentity Center
Connectez vos dépôts
Utilisation de l'agent
Mode autonomeAutomatisationsMémoire
Sandbox

Mobile - Aperçu

Aperçu

Commandes et référence

Commandes CLICommandes à barre obliqueOutils intégrésCodes de sortieParamètres

Facturation

AperçuGestion de votre abonnementMise à niveau de votre forfaitRétrogradation de votre forfaitAnnulation de votre forfaitAchat de crédits supplémentairesGestion de vos paiementsGestion des notifications d'utilisationGestion de vos impôtsCommuniquer avec le soutien à la facturationSuppression de votre compteQuestions connexes

Entreprise

ConceptsDémarrage rapide de l'intégration
Connexion de votre fournisseur d'identité
Abonnez votre équipeGérer les abonnements
Governance
Surveillance et suivi
ParamètresMises à jour géréesFacturationIAMRégions prises en charge

Confidentialité et sécurité

AperçuProtection des donnéesRéférences de codeValidation de la conformitéSécurité de l'infrastructureAutorisations IAMPare-feu, mandataires et périmètres de donnéesPoints de terminaison VPC (AWS PrivateLink)

Guides

Aperçu
Prise en charge des langages
Apprendre en jouant

Migration

Migration depuis Q DeveloperMigration depuis VSCodeMise à niveau depuis Q CLI
  1. Docs
  2. Modèles
  3. Effort de raisonnement
Afficher en Markdown

Effort de raisonnement

Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et la version anglaise originale, la version anglaise prévaudra.
Afficher en Markdown

L'effort de raisonnement contrôle la quantité de réflexion que le modèle applique à vos requêtes. Des niveaux d'effort plus bas produisent des réponses plus rapides et plus courtes et utilisent moins de crédits. Des niveaux plus élevés consacrent plus de jetons à une analyse plus approfondie, à un raisonnement en plusieurs étapes et à une génération de code approfondie.

CapacitéIDECLIWebMobile
Sélection de l'effort de raisonnement✓✓——

Niveaux disponibles :

NiveauComportement
lowRéponses rapides et concises. Convient pour les questions simples et les recherches rapides.
mediumRaisonnement équilibré. Convient pour la plupart des tâches de développement.
highAnalyse approfondie. Mieux adapté pour la refactorisation complexe et les décisions d'architecture.
xhighRaisonnement étendu. Utile pour les modifications multi-fichiers et les problèmes nuancés.
maxProfondeur maximale. Idéal pour le débogage difficile, l'analyse de sécurité et la logique complexe.

Tous les modèles ne prennent pas en charge tous les niveaux. Le sélecteur affiche uniquement les niveaux disponibles pour votre modèle actuel - voir les modèles pris en charge ci-dessous.

Définir le niveau d'effort

Cliquez sur le nom du modèle dans la barre de saisie du chat pour ouvrir le sélecteur de modèle, puis choisissez un niveau d'effort dans le panneau Effort sur le côté droit.

Votre sélection d'effort apparaît à côté du nom du modèle (p. ex., « Claude Opus 4.6 · max ») et s'applique à tous les messages suivants dans la conversation.

Modèles pris en charge

Chaque modèle définit les valeurs qu'il accepte pour les champs liés au raisonnement dans son schéma de configuration. La colonne output_config.effort répertorie les niveaux d'effort disponibles pour ce modèle; thinking.type et thinking.display contrôlent le comportement et la visibilité du raisonnement; max_tokens définit la limite de longueur de sortie.

Les modèles Claude utilisent output_config.effort avec les contrôles thinking.type et thinking.display :

Modèlethinking.typethinking.displayoutput_config.effortmax_tokens
Claude Opus 5adaptive, disabledsummarized, omittedlow, medium, high, xhigh, max1024–128000
Claude Opus 4.8adaptive, disabledsummarized, omittedlow, medium, high, xhigh, max1024–128000
Claude Opus 4.7adaptive, disabledsummarized, omittedlow, medium, high, xhigh, max1024–64000
Claude Opus 4.6adaptive, disabledsummarized, omittedlow, medium, high, max1024–64000
Claude Sonnet 5adaptive, disabledsummarized, omittedlow, medium, high, xhigh, max1024–128000
Claude Sonnet 4.6adaptive, disabledsummarized, omittedlow, medium, high, max1024–64000

Les modèles GPT-5.6 utilisent reasoning.effort :

Modèlereasoning.effort
GPT-5.6 Terranone, low, medium, high, xhigh, max
GPT-5.6 Solnone, low, medium, high, xhigh, max
GPT-5.6 Lunanone, low, medium, high, xhigh, max

Les modèles GPT-5.6 utilisent par défaut effort: "high".

Persistance de votre niveau d'effort (CLI)

Votre choix d'effort persiste automatiquement. Définissez un niveau avec /effort ou --effort et Kiro s'en souvient pour les sessions futures - il n'y a aucune étape supplémentaire pour en faire la valeur par défaut. Les préférences sont stockées dans ~/.kiro/settings/cli.json. Consultez Paramètres en session pour en savoir plus sur la persistance des préférences.

Valeurs par défaut persistantes (CLI)

Pour définir des paramètres de modèle par défaut par modèle - afin de ne pas avoir à exécuter /effort au début de chaque session - ajoutez chat.modelDefaults à votre fichier de paramètres :

Modèles Claude (utilisent output_config.effort) :

json
{ "chat.modelDefaults": { "claude-sonnet-4.6": { "output_config": { "effort": "high" } }, "claude-opus-4.7": { "output_config": { "effort": "max" } } } }

Modèles GPT-5.6 (utilisent reasoning.effort) :

json
{ "chat.modelDefaults": { "gpt-5.6-sol": { "reasoning": { "effort": "max" } }, "gpt-5.6-terra": { "reasoning": { "effort": "low" } } } }

Configuration du comportement de réflexion

Contrôlez si le modèle utilise le raisonnement étendu et comment il affiche son raisonnement :

json
{ "chat.modelDefaults": { "claude-opus-4.8": { "thinking": { "type": "adaptive", "display": "summarized" } }, "claude-sonnet-4.6": { "thinking": { "type": "disabled" } } } }
  • thinking.type - adaptive active le raisonnement étendu lorsque le modèle détermine que c'est nécessaire; disabled le désactive entièrement.
  • thinking.display - summarized affiche une version condensée du raisonnement; omitted le masque de la sortie. S'applique seulement lorsque type est adaptive.

Configuration du nombre maximal de jetons de sortie

Définissez le nombre maximal de jetons que le modèle peut générer par réponse :

json
{ "chat.modelDefaults": { "claude-opus-4.8": { "max_tokens": 128000 }, "claude-sonnet-4.6": { "max_tokens": 32000 } } }

Limites de max_tokens par modèle :

ModèleMinimumMaximum
Claude Opus 4.81024128000
Claude Opus 4.7102464000
Claude Opus 4.6102464000
Claude Sonnet 51024128000
Claude Sonnet 4.6102464000
GPT-5.6 Terra1024128000
GPT-5.6 Sol1024128000
GPT-5.6 Luna1024128000

Combinaison de toutes les options

Vous pouvez combiner output_config, thinking et max_tokens dans une seule entrée de modèle :

Exemple Claude :

json
{ "chat.modelDefaults": { "claude-opus-4.8": { "output_config": { "effort": "max" }, "thinking": { "type": "adaptive", "display": "summarized" }, "max_tokens": 128000 } } }

Exemple GPT-5.6 :

json
{ "chat.modelDefaults": { "gpt-5.6-sol": { "reasoning": { "effort": "max" }, "max_tokens": 128000 } } }

Pour ouvrir votre fichier de paramètres dans votre éditeur :

bash
kiro-cli settings open

Ou placez un fichier .kiro/settings/cli.json dans la racine de votre projet pour définir des valeurs par défaut au niveau de l'espace de travail qui s'appliquent à tous ceux qui travaillent dans ce dépôt.

Priorité

Lors de la détermination du niveau d'effort pour une session, Kiro applique cet ordre de priorité :

  1. Substitution de session - valeur définie via le sélecteur d'effort, /effort, ou --effort durant la session actuelle
  2. Valeurs par défaut de l'espace de travail - chat.modelDefaults dans .kiro/settings/cli.json
  3. Valeurs par défaut de l'utilisateur - chat.modelDefaults dans ~/.kiro/settings/cli.json
  4. Valeurs par défaut intégrées - le niveau d'effort standard du modèle

Quand ajuster l'effort

  • Augmentez lorsque l'agent donne des réponses superficielles, manque des cas limites ou produit des implémentations incomplètes
  • Diminuez lorsque vous avez besoin de réponses rapides et ne voulez pas attendre un raisonnement étendu
  • Utilisez max pour les révisions de sécurité, les sessions de débogage complexes, ou lorsque vous avez besoin que l'agent prenne en compte de nombreuses contraintes interdépendantes

Voir aussi

  • Modèles - modèles disponibles et leurs capacités
  • Référence des commandes slash - référence rapide des commandes
  • Paramètres - tous les paramètres configurables
Page mise à jour : 11 août 2026
Modèles disponibles
Comment fonctionne Kiro