Chargement de l'image...Kiro

Produit

  • À propos de Kiro
  • IDE
  • CLI
  • Web
  • Mobile
  • Crew
  • Tarification
  • Téléchargements

Pour

  • Entreprise
  • Startups
  • Étudiants

Communauté

  • Aperçu
  • Ambassadeurs
  • Discord
  • Événements
  • Powers
  • Boutique
  • Vitrine

Ressources

  • Docs
  • Blogue
  • Journal des modifications
  • FAQ
  • Signaler un bogue
  • Suggérer une idée
  • Soutien à la facturation

Réseaux sociaux

Conditions d'utilisation du siteLicencePolitique d'IA responsableMentions légalesPolitique de confidentialitéPréférences relatives aux témoins
Chargement de l'image...Kiro
  • Entreprise
  • Tarification
  • Docs
SE CONNECTERTÉLÉCHARGER
Chargement de l'image...Kiro

Pour commencer

InstallationAuthentificationVotre premier projet

Modèles

AperçuModèles disponiblesEffort de raisonnement

Fonctionnalités

Comment fonctionne Kiro
Specs
Steering
Hooks
MCP
Autorisations
Agents personnalisés
Agent Skills
Powers
Sessions cloudCompactionKiroignorePoints de contrôle et rewind
Outils intégrés
Portées de configuration

IDE 1.x

Nouveautés de la version 1.0
Configuration et premier lancement
Éditeur
Chat
Expérimental
DépannageRéférence 0.x

CLI

Nouveautés de la version 3.0
Configuration et première exécution
Interface utilisateur du terminal
Clavardage
Mode vocalMode sans interfaceACPAutocomplétion
Expérimental
Référence 2.x

Crew

Démarrage rapideInstallationFonctionnement 24/7
Chat
Sessions
Contrôles des messages
Optimiseur de requêtes
Voice
Sortie enrichie et widgets
Agent Capabilities
Fonctionnalités
Interfaces
Applications
ConfigurationSécuritéDépannage

Web - Aperçu

Configuration et première exécutionIdentity Center
Connectez vos dépôts
Utilisation de l'agent
Mode autonomeAutomatisationsMémoire
Sandbox

Mobile - Aperçu

Aperçu

Commandes et référence

Commandes CLICommandes à barre obliqueOutils intégrésCodes de sortieParamètres

Facturation

AperçuGestion de votre abonnementMise à niveau de votre forfaitRétrogradation de votre forfaitAnnulation de votre forfaitAchat de crédits supplémentairesGestion de vos paiementsGestion des notifications d'utilisationGestion de vos impôtsCommuniquer avec le soutien à la facturationSuppression de votre compteQuestions connexes

Entreprise

ConceptsDémarrage rapide de l'intégration
Connexion de votre fournisseur d'identité
Abonnez votre équipeGérer les abonnements
Governance
Surveillance et suivi
ParamètresMises à jour géréesFacturationIAMRégions prises en charge

Confidentialité et sécurité

AperçuProtection des donnéesRéférences de codeValidation de la conformitéSécurité de l'infrastructureAutorisations IAMPare-feu, mandataires et périmètres de donnéesPoints de terminaison VPC (AWS PrivateLink)

Guides

Aperçu
Prise en charge des langages
Apprendre en jouant

Migration

Migration depuis Q DeveloperMigration depuis VSCodeMise à niveau depuis Q CLI
  1. Docs
  2. Crew
  3. Chat
  4. Voice
Afficher en Markdown

Voice

Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et la version anglaise originale, la version anglaise prévaudra.
Afficher en Markdown

Voice est un mode d'entrée et de sortie de première classe dans Crew. Le fournisseur par défaut — Piper — s'exécute localement, si bien que rien ne quitte votre machine. La reconnaissance vocale (STT) infonuagique via AWS Transcribe est un supplément facultatif.

Deux modes : entrée et sortie

  • Speech-to-text (STT) — appuyez sur le bouton du micro et commencez à parler; les résultats partiels en direct s'affichent dans le champ de saisie du clavardage
  • Text-to-speech (TTS) — les réponses sont énoncées à voix haute par vos haut-parleurs, diffusées mot par mot au fur et à mesure que l'agent les génère

Les deux modes sont sur demande. L'entrée vocale ne se déclenche jamais avant que vous n'appuyiez sur le micro; la sortie vocale ne joue jamais à moins que vous ne l'activiez par session ou globalement.

Entrée vocale (STT)

Transcription en continu

Maintenez enfoncé ou cliquez sur le bouton du micro dans le champ de saisie du clavardage du tableau de bord.

  • Les résultats partiels en direct s'affichent dans la zone de texte pendant que vous parlez
  • Un silence d'environ 1,5 s finalise automatiquement la transcription
  • Cliquez de nouveau sur le bouton pour arrêter plus tôt

En arrière-plan, l'audio est diffusé en continu vers /api/stt (WebSocket), qui l'achemine vers le fournisseur choisi et renvoie les événements de transcription en temps réel.

Choisir un fournisseur

Configurez le fournisseur STT dans ~/.kiro/crew/config.json :

json
{ "voice": { "stt_provider": "whisper" } }
FournisseurS'exécute oùNotes
whisper (par défaut)LocalUtilise Whisper localement si disponible; se rabat sur la reconnaissance vocale intégrée du navigateur
aws_transcribeInfonuagiqueNécessite le supplément d'installation voice + des identifiants AWS
browserLocal (navigateur)Utilise l'API Web Speech du navigateur — la qualité varie selon le navigateur

Installez le supplément STT infonuagique :

bash
pip install "kirocrew[voice]"

Notes vocales

Joignez une note vocale comme fichier avec @filename — l'audio est transcrit automatiquement et intégré au message. Utile lorsque vous voulez laisser une note vocale dans un message existant sans déclencher le micro en direct.

Sortie vocale (TTS)

Piper — le fournisseur par défaut

Piper est un moteur TTS neuronal local et rapide. Il s'exécute entièrement sur votre machine (aucune connexion Internet requise) et diffuse l'audio mot par mot au fur et à mesure que l'agent génère sa réponse.

  • Activez le TTS depuis l'en-tête de l'onglet de clavardage (icône 🔊)
  • La réponse est énoncée pendant sa diffusion — vous entendez la première phrase avant même que le modèle ait terminé la dernière
  • Désactivez avec le même bouton

Les fichiers de voix Piper sont téléchargés à la première utilisation, puis mis en cache localement.

Configuration

json
{ "voice": { "tts_provider": "piper", "tts_voice": "en_US-amy-medium", "tts_speed": 1.0 } }
CléValeur par défautObjectif
voice.tts_providerpiperMoteur TTS (seulement piper pour l'instant)
voice.tts_voiceen_US-amy-mediumFichier de voix Piper à utiliser
voice.tts_speed1.0Vitesse de lecture (0,5–2,0)

Voix disponibles : n'importe quel fichier de voix Piper. Déposez un fichier .onnx dans ~/.kiro/crew/voices/ et référencez-le par son nom de fichier.

Quand la sortie vocale s'interrompt

Le TTS est conçu pour s'effacer en arrière-plan :

  • Les blocs de code sont ignorés (ils seraient inécoutables)
  • Les blocs d'appel d'outil sont ignorés
  • Les URL longues sont lues comme « URL » plutôt que caractère par caractère
  • Les titres Markdown sont lus avec un léger changement de hauteur tonale

Vous pouvez remplacer chacun de ces comportements depuis le panneau des paramètres vocaux.

Interruption

La sortie vocale peut être interrompue de la même façon qu'un tour de clavardage :

  • Cliquez sur ⏹ Arrêter pour annuler à la fois la réponse en continu et le TTS
  • La commande !stop dans Slack fait de même pour une utilisation multiplateforme

L'interruption est bidirectionnelle : arrêter la réponse arrête aussi le TTS en plein mot.

Utilisation multiplateforme

L'entrée vocale est réservée au tableau de bord pour l'instant. Les notes vocales Slack fonctionnent grâce à la fonction de note vocale de Slack. Le Kiro CLI dispose de son propre mode vocal distinct (reconnaissance vocale Whisper locale); consultez le mode Voice du CLI.

La sortie vocale fonctionne partout où le tableau de bord est ouvert — y compris sur des hôtes distants accédés par un tunnel SSH ou un tunnel mobile. Le flux audio est livré sous forme de messages WebSocket fragmentés, donc la latence dépend de votre réseau.

Notes sur la confidentialité

  • Piper TTS — entièrement local; aucun audio ne quitte la machine
  • Whisper STT — local lorsqu'il est installé; se rabat sur la reconnaissance vocale du navigateur (qui peut utiliser le service infonuagique d'un fournisseur du navigateur)
  • AWS Transcribe — l'audio est diffusé en continu vers AWS; à activer uniquement avec le supplément voice installé et des identifiants configurés

Piper est le fournisseur par défaut, car c'est le seul qui ne quitte jamais la machine.

Dépannage

ProblèmeSolution
Le bouton du micro ne fait rienAccordez la permission d'accès au microphone du navigateur pour l'origine du tableau de bord
Le TTS est silencieuxVérifiez la permission audio de l'onglet du tableau de bord; confirmez que la sortie audio du système n'est pas coupée
Voix Piper manquanteLa première utilisation télécharge le fichier de voix; vérifiez ~/.kiro/crew/voices/ et la connectivité réseau
La transcription est inexacteEssayez une pièce plus silencieuse, passez à aws_transcribe si vous avez besoin d'une précision de niveau infonuagique
Le STT s'arrête en plein milieu d'une phraseLa détection de silence est agressive — maintenez le bouton enfoncé plutôt que de cliquer pour parler
Page mise à jour : 19 août 2026
Optimiseur de requêtes
Sortie enrichie et widgets