Chargement de l'image...Kiro

Produit

  • À propos de Kiro
  • Agents
  • IDE
  • CLI
  • Web
  • Mobile
  • Crew
  • Tarification
  • Téléchargements

Pour

  • Entreprise
  • Startups
  • Étudiants

Communauté

  • Aperçu
  • Ambassadeurs
  • Études de cas
  • Discord
  • Événements
  • Powers
  • Boutique
  • Vitrine

Ressources

  • Docs
  • Blogue
  • Journal des modifications
  • FAQ
  • Signaler un bogue
  • Suggérer une idée
  • Soutien à la facturation

Réseaux sociaux

Conditions d'utilisation du siteLicencePolitique d'IA responsableMentions légalesPolitique de confidentialitéPréférences relatives aux témoins
Chargement de l'image...Kiro
  • Agents
  • Entreprise
  • Tarification
  • Docs
SE CONNECTERTÉLÉCHARGER
Chargement de l'image...Kiro

Pour commencer

InstallationAuthentificationVotre premier projet

Modèles

AperçuModèles disponiblesEffort de raisonnementModèles AWS GovCloud (US)

Fonctionnalités

Comment fonctionne KiroIntégrations ACP
Specs
Steering
Hooks
MCP
Autorisations
Agents personnalisés
Workflows
Agent Skills
Powers
Sessions cloudCompactionKiroignorePoints de contrôle et rewind
Outils intégrés
Portées de configuration

IDE 1.x

Nouveautés de la version 1.0
Configuration et premier lancement
Éditeur
Chat
Expérimental
DépannageRéférence 0.x

CLI

Nouveautés de V3
Configuration et première exécution
Interface utilisateur du terminal
Clavardage
Mode plein écranMode vocalMode sans interfaceACPAutocomplétion
Expérimental
Référence 2.x

Crew

Démarrage rapideInstallationFonctionnement 24/7
Chat
Sessions
Contrôles des messages
Optimiseur de requêtes
Voice
Sortie enrichie et widgets
Agent Capabilities
Fonctionnalités
Interfaces
Applications
Système et stockageConfigurationSécuritéDépannage

Web

Configuration et première exécutionIdentity Center
Connectez vos dépôts
Utilisation de l'agent
Mode autonomeAutomatisationsMémoireSynchronisation de la configuration
Sandbox

Mobile - Aperçu

Aperçu

Commandes et référence

Commandes CLICommandes à barre obliqueOutils intégrésCodes de sortieParamètres

Facturation

AperçuGestion de votre abonnementMise à niveau de votre forfaitRétrogradation de votre forfaitAnnulation de votre forfaitAchat de crédits supplémentairesGestion de vos paiementsGestion des notifications d'utilisationGestion de vos impôtsCommuniquer avec le soutien à la facturationSuppression de votre compteQuestions connexes

Entreprise

ConceptsDémarrage rapide de l'intégration
Connexion de votre fournisseur d'identité
Options de déploiementAbonnez votre équipeGérer les abonnements
Governance
Surveillance et suivi
ParamètresMises à jour géréesFacturationIAMRégions prises en charge

Confidentialité et sécurité

AperçuProtection des donnéesRéférences de codeValidation de la conformitéSécurité de l'infrastructureAutorisations IAMPare-feu, mandataires et périmètres de donnéesPoints de terminaison VPC (AWS PrivateLink)

Guides

Aperçu
Prise en charge des langages
Apprendre en jouant

Migration

Migration depuis Q DeveloperMigration depuis VSCodeMise à niveau depuis Q CLI
  1. Docs
  2. Crew
  3. Chat
  4. Voice
Afficher en Markdown

Voice

Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et la version anglaise originale, la version anglaise prévaudra.
Afficher en Markdown

Voice est un mode d'entrée et de sortie de première classe dans Crew. Le fournisseur STT local par défaut s'exécute dans le processus et télécharge son propre modèle à la première utilisation, de sorte que la dictée fonctionne sans installer de binaire externe. Un fournisseur infonuagique AWS Transcribe facultatif est également disponible. La synthèse texte-parole locale Piper (TTS) pour les réponses ne nécessite aucun service infonuagique.

Deux modes : entrée et sortie

  • Speech-to-text (STT) : appuyez sur le bouton du micro et commencez à parler; le texte en direct est diffusé dans le champ de saisie du clavardage pendant que vous parlez
  • Text-to-speech (TTS) : les réponses sont énoncées à voix haute par vos haut-parleurs, diffusées mot par mot au fur et à mesure que l'agent les génère

Les deux modes sont sur demande. L'entrée vocale ne se déclenche jamais avant que vous n'appuyiez sur le micro; la sortie vocale ne joue jamais à moins que vous ne l'activiez par session ou globalement.

Entrée vocale (STT)

Le fournisseur local

Crew exécute un seul fournisseur STT local dans le processus. Il télécharge un modèle à la première utilisation et le maintient chargé, de sorte qu'un court énoncé est transcrit en quelques dizaines de millisecondes. Aucun binaire externe n'est requis. La dictée fonctionne dans les installations de bureau macOS.

Si une installation à partir du code source nécessite son décodeur audio, ouvrez Parametres → Voix et choisissez Télécharger le décodeur. Crew télécharge un décodeur vérifié quand il est disponible, au lieu de vous demander d'installer ffmpeg manuellement.

Deux tailles de modèle sont disponibles :

ModèleTaille du téléchargementNotes
base (par défaut)~148 MBRapide, fonctionne bien pour la plupart des dictées
turbo~1.6 GBPrécision supérieure; un réglage turbo enregistré lors d'une installation antérieure fonctionne toujours

La valeur par défaut pour les nouvelles installations est base. Un réglage turbo enregistré lors d'une installation antérieure est correctement résolu, mais déclenche le téléchargement plus volumineux.

json
{ "voice": { "stt_model": "base" } }
Info

Les fournisseurs whisper, mlx, parakeet et faster des versions antérieures sont retirés. Les réglages enregistrés qui nomment l'un de ces fournisseurs reviennent automatiquement à local. Exécutez kirocrew config defaults pour lister les valeurs enregistrées qui conservent encore des valeurs par défaut remplacées, puis utilisez --adopt ou --keep pour décider.

AWS Transcribe (fournisseur infonuagique facultatif)

Pour une précision de niveau infonuagique, un fournisseur AWS Transcribe est disponible. Il diffuse l'audio vers AWS et nécessite le supplément voice ainsi que des identifiants AWS configurés dans votre environnement.

Installez le supplément :

bash
pip install "kirocrew[voice]"

Configurez le fournisseur :

json
{ "voice": { "stt_provider": "transcribe" } }

Texte en direct

Pendant votre dictée, les mots en cours apparaissent dans la zone de texte et se stabilisent lorsque le modèle consolide sa transcription. Un silence d'environ 1,5 seconde finalise l'énoncé. Cliquez de nouveau sur le bouton du micro pour arrêter plus tôt.

Le texte en direct est activé par défaut pour les nouvelles installations. Si vous avez effectué une mise à niveau depuis une version antérieure, vérifiez Paramètres → Voix pour l'activer.

Filtrage du silence

Les hallucinations de silence du modèle et le texte passe-partout des sous-titres, comme « Thank you for watching », sont filtrés avant que le texte n'atteigne votre saisie.

Appuyer pour parler

Maintenez une touche enfoncée pour dicter, ou appuyez dessus pour verrouiller la dictée jusqu'à ce que vous appuyiez de nouveau. Configurez la touche, le mode et testez la bande dans Paramètres → Voix.

Notes vocales

Joignez une note vocale comme fichier avec @filename. L'audio est transcrit automatiquement et intégré au message.

Sortie vocale (TTS)

Piper (le fournisseur par défaut)

Piper est un moteur TTS neuronal local et rapide. Il s'exécute entièrement sur votre machine et diffuse l'audio mot par mot au fur et à mesure que l'agent génère sa réponse.

  • Activez le TTS depuis l'en-tête de l'onglet de clavardage (icône 🔊)
  • Vous entendez la première phrase avant même que le modèle ait terminé la dernière
  • Désactivez avec le même bouton

Les fichiers de voix Piper sont téléchargés à la première utilisation et mis en cache localement.

Configuration

json
{ "voice": { "tts_provider": "piper", "tts_voice": "en_US-amy-medium", "tts_speed": 1.0 } }
CléValeur par défautObjectif
voice.tts_providerpiperMoteur TTS (seulement piper pour l'instant)
voice.tts_voiceen_US-amy-mediumFichier de voix Piper à utiliser
voice.tts_speed1.0Vitesse de lecture (0,5 à 2,0)

Voix disponibles : n'importe quel fichier de voix Piper. Déposez un fichier .onnx dans ~/.kiro/crew/voices/ et référencez-le par son nom de fichier.

Application des réglages sans redémarrage

Les réglages vocaux qui nécessitent un redémarrage de la passerelle proposent l'action de redémarrage directement dans le panneau des réglages. Vous n'avez pas besoin de naviguer ailleurs ni de trouver une commande de redémarrage distincte.

Quand la sortie vocale se met en pause

Le TTS ignore le contenu qui serait inécoutable :

  • Blocs de code
  • Blocs d'appel d'outil
  • URL longues, lues comme « URL »
  • Titres Markdown, lus avec un léger changement de hauteur tonale

Remplacez n'importe lequel de ces comportements depuis le panneau des réglages vocaux.

Interruption

La sortie vocale s'arrête lorsque vous arrêtez le tour :

  • Cliquez sur ⏹ Arrêter pour annuler à la fois la réponse en continu et le TTS
  • La commande !stop dans Slack fait de même pour une utilisation multiplateforme

L'interruption est bidirectionnelle : arrêter la réponse arrête aussi le TTS en plein mot.

Utilisation multiplateforme

L'entrée vocale est réservée au tableau de bord. Les notes vocales Slack fonctionnent grâce à la fonction de note vocale de Slack. Le Kiro CLI dispose de son propre mode vocal distinct; consultez le mode Voice du CLI.

La sortie vocale fonctionne partout où le tableau de bord est ouvert, y compris sur des hôtes distants accédés par un tunnel SSH ou un accès mobile.

Notes sur la confidentialité

  • STT local : l'audio est traité dans le processus; rien ne quitte votre machine
  • AWS Transcribe : l'audio est diffusé vers AWS; activez-le uniquement avec le supplément voice installé et des identifiants configurés
  • Piper TTS : entièrement local; aucun audio ne quitte la machine

Dépannage

ProblèmeSolution
Le bouton du micro ne fait rienAccordez la permission d'accès au microphone du navigateur pour l'origine du tableau de bord
Le TTS est silencieuxVérifiez la permission audio de l'onglet du tableau de bord; confirmez que la sortie audio du système n'est pas coupée
Le modèle STT n'est pas téléchargéVérifiez Paramètres → Voix et votre connexion réseau; le modèle se télécharge une seule fois, à la première utilisation
La transcription est inexacteEssayez une pièce plus silencieuse, passez au modèle turbo ou utilisez AWS Transcribe pour une précision de niveau infonuagique
Le texte en direct ne s'affiche pasActivez le texte en direct dans Paramètres → Voix
La modification d'un réglage exige un redémarrageUtilisez l'action de redémarrage dans le panneau des réglages vocaux
Page mise à jour : 12 septembre 2026
Optimiseur de requêtes
Sortie enrichie et widgets