Opus 4.7 est maintenant disponible dans Kiro

Par
NI

Nima Kaviani

Product

Dès aujourd'hui, Claude Opus 4.7 est déployé dans l'IDE et la CLI de Kiro. Opus 4.7 est le plus récent modèle Opus d'Anthropic, et le plus performant, une mise à niveau directe par rapport à Opus 4.6, avec une performance en programmation accrue sur des tâches complexes et de longue durée.

Chargement de l'image...Comparison table of AI model performance across 14 benchmarks for five models: Opus 4.7, Opus 4.6, GPT-5.4, Gemini 3.1 Pro, and Mythos Preview. Agentic coding on SWE-bench Pro: Opus 4.7 64.3%, Opus 4.6 53.4%, GPT-5.4 57.7%, Gemini 3.1 Pro 54.2%, Mythos Preview 77.8%. Agentic coding on SWE-bench Verified: Opus 4.7 87.6%, Opus 4.6 80.8%, GPT-5.4 N/A, Gemini 3.1 Pro 80.6%, Mythos Preview 93.9%. Agentic terminal coding (Terminal Bench 2.0): Opus 4.7 69.4%, Opus 4.6 65.4%, GPT-5.4 75.1%, Gemini 3.1 Pro 68.5%, Mythos Preview 82.0%. Multidisciplinary reasoning (Humanity's Last Exam) no tools: Opus 4.7 46.9%, Opus 4.6 40.0%, GPT-5.4 42.7%, Gemini 3.1 Pro 44.4%, Mythos Preview 56.8%. Multidisciplinary reasoning with tools: Opus 4.7 54.7%, Opus 4.6 53.3%, GPT-5.4 58.7%, Gemini 3.1 Pro 51.4%, Mythos Preview 64.7%. Agentic search (BrowseComp): Opus 4.7 79.3%, Opus 4.6 83.7%, GPT-5.4 89.3%, Gemini 3.1 Pro 85.9%, Mythos Preview 86.9%. Scaled tool use (MCP-Atlas): Opus 4.7 77.3%, Opus 4.6 75.8%, GPT-5.4 68.1%, Gemini 3.1 Pro 73.9%, Mythos Preview N/A. Agentic computer use (OSWorld-Verified): Opus 4.7 78.0%, Opus 4.6 72.7%, GPT-5.4 75.0%, Gemini 3.1 Pro N/A, Mythos Preview 79.6%. Agentic financial analysis (Finance Agent v11): Opus 4.7 64.4%, Opus 4.6 60.1%, GPT-5.4 61.5%, Gemini 3.1 Pro 59.7%, Mythos Preview N/A. Cybersecurity vulnerability reproduction (CyberGym): Opus 4.7 73.1%, Opus 4.6 73.8%, GPT-5.4 66.3%, Gemini 3.1 Pro N/A, Mythos Preview 83.1%. Graduate-level reasoning (GPQA Diamond): Opus 4.7 94.2%, Opus 4.6 91.3%, GPT-5.4 94.4%, Gemini 3.1 Pro 94.3%, Mythos Preview 94.6%. Visual reasoning (CharXiv Reasoning) no tools: Opus 4.7 82.1%, Opus 4.6 69.1%, GPT-5.4 N/A, Gemini 3.1 Pro N/A, Mythos Preview 86.1%. Visual reasoning with tools: Opus 4.7 91.0%, Opus 4.6 84.7%, GPT-5.4 N/A, Gemini 3.1 Pro N/A, Mythos Preview 93.2%. Multilingual Q&A (MMLU): Opus 4.7 91.5%, Opus 4.6 91.1%, GPT-5.4 N/A, Gemini 3.1 Pro 92.6%, Mythos Preview N/A. Opus 4.7 is highlighted with an orange border. Mythos Preview leads in most benchmarks where tested; graduate-level reasoning scores are consistently above 91% across all models.

Opus 4.7 résout plus de tâches de production que son prédécesseur et suit des instructions complexes avec plus de précision sur des sessions plus longues. Il gère des implémentations à plusieurs étapes qui s'étendent sur plusieurs fichiers et outils, vérifie ses propres résultats avant de les retourner, et reste plus fidèle à ce que vous avez demandé grâce à un suivi plus rigoureux.

Ces améliorations se répercutent sur le développement piloté par les specs de Kiro. Nous considérons Opus 4.7 comme le modèle le mieux adapté pour transposer des specs détaillées vers l'implémentation avec une fidélité accrue sur des bases de code plus vastes et des changements plus larges. Dans les flux de travail qui passent entre la planification, l'utilisation d'outils, l'exécution et la révision, il maintient le fil avec moins de dérive.

Opus 4.7 est déployé progressivement avec un soutien expérimental à un sous-ensemble de clients Kiro Pro, Pro+ et Power qui se connectent avec AWS IAM Identity Center dans les régions AWS US-East-1 (Virginie du Nord) et AWS Europe (Francfort), avec un soutien de l'inférence entre régions et une disponibilité élargie à venir. Il est offert avec la fenêtre contextuelle complète de 1 M, un multiplicateur de crédits de 2,2x, identique à celui d'Opus 4.6.

Téléchargez Kiro ou redémarrez l'application ou la CLI pour vérifier la disponibilité des plus récents modèles.