Sonnet 5 est maintenant disponible dans Kiro

Dès aujourd'hui, Claude Sonnet 5 est disponible dans Kiro IDE, CLI et Web. C'est le modèle Sonnet le plus agentif d'Anthropic à ce jour, une amélioration substantielle par rapport à Sonnet 4.6, avec un raisonnement, une utilisation d'outils et une programmation plus robustes — et à un prix de classe Sonnet.

Un comportement agentif quasi de classe Opus à des prix de classe Sonnet

Pour de nombreux développeurs, l'ère de l'intelligence artificielle agentive a commencé avec les modèles de classe Sonnet. Plus récemment, les gains les plus nets en matière de capacité agentive se sont manifestés dans la gamme Opus. Sonnet 5 réduit cet écart. Sa performance s'approche de celle d'Opus 4.8 en matière de raisonnement, d'utilisation d'outils, de programmation et de travail axé sur les connaissances, à un coût nettement moindre.

Dans Kiro, cela vous donne un véritable levier coût-performance. Utilisez Opus 4.8 lorsque vous voulez une précision maximale sur les tâches les plus difficiles; utilisez Sonnet 5 lorsque vous voulez un comportement agentif solide à un prix qui vous permet d'en faire tourner davantage. Entre les deux, vous pouvez ajuster les niveaux d'effort pour trouver le bon équilibre pour chaque tâche.

Conçu pour le travail agentif de bout en bout

Chargement de l'image...Table compares benchmark performance across three AI models: Sonnet 5 (highlighted with an orange border as the primary model under evaluation), Sonnet 4.6, and Opus 4.8 (noted as 'For reference'). Results are organized across five evaluation categories. In Agentic coding on SWE-bench Pro, Sonnet 5 scores 63.2%, Sonnet 4.6 scores 58.1%, and Opus 4.8 scores 69.2%. In Agentic coding on Terminal-Bench 2.1, Sonnet 5 achieves 80.4%, Sonnet 4.6 achieves 67.0%, and Opus 4.8 achieves 82.7%. In Multidisciplinary reasoning on Humanity's Last Exam without tools, Sonnet 5 reaches 43.2%, Sonnet 4.6 reaches 34.6%, and Opus 4.8 reaches 49.8%; with tools, Sonnet 5 scores 57.4%, Sonnet 4.6 scores 46.8%, and Opus 4.8 scores 57.9%. In Computer use on OSWorld-Verified, Sonnet 5 scores 81.2%, Sonnet 4.6 scores 78.5%, and Opus 4.8 scores 83.4%. In Knowledge work on GDPval-AA v2, Sonnet 5 scores 1618, Sonnet 4.6 scores 1395, and Opus 4.8 scores 1615.

Dans Kiro IDE, CLI et Web, Sonnet 5 planifie avant de modifier, fonctionne plus longtemps sans supervision et vérifie son propre résultat sans qu'on le lui demande explicitement. Les premiers testeurs l'ont systématiquement décrit comme menant à terme des tâches complexes là où les modèles Sonnet précédents s'arrêtaient avant la fin.

Pour les flux de travail axés sur les specs dans l'IDE, cela se traduit par une implémentation de plus grande fidélité pour des changements plus vastes, avec moins de dérive par rapport à la spec. Pour la CLI et le Web, les tâches agentives à plusieurs étapes — navigation, utilisation du terminal, remaniements multifichiers — sont menées à terme de façon plus fiable, avec moins d'impasses et moins besoin de supervision étroite.

Disponibilité

Sonnet 5 est déployé progressivement, avec prise en charge expérimentale, pour les clientes et clients Kiro Pro, Pro+, Pro Max et Power dans les régions AWS US-East-1 (Virginie du Nord) et AWS Europe (Francfort), avec prise en charge de l'inférence interrégionale. Il est offert avec la fenêtre contextuelle complète de 1 M, un multiplicateur de crédits de 1,3x, identique à celui de Sonnet 4.6.

Remarque sur les changements de tokeniseur : Sonnet 5 utilise un tokeniseur mis à jour qui traite le texte de façon légèrement différente de Sonnet 4.6. La même entrée peut correspondre à environ 1,0 à 1,35 fois plus de jetons selon le type de contenu.

Téléchargez Kiro ou redémarrez l'IDE ou la CLI pour vérifier les derniers modèles disponibles. Les utilisatrices et utilisateurs du Web peuvent actualiser leur navigateur pour voir Sonnet 5 dans le sélecteur de modèles.