Claude Opus 4.1

2025-08-05 · Éditeur : Anthropic · Domaine : Intelligence Artificielle

Anthropic publie Claude Opus 4.1, mise à jour d'Opus 4 avec de meilleures performances en codage, en agents et en raisonnement, au même prix. L'éditeur recommande de migrer depuis Opus 4 pour tous les usages.

Ce qui change

  • 74,5 % sur SWE-bench Verified, contre 72,5 % pour Opus 4.
  • Progrès notables en refactorisation multi-fichiers (retour de GitHub) et en recherche et suivi de détails.
  • Corrections plus précises dans de grandes bases de code, sans modifications inutiles (retour de Rakuten).
  • Windsurf mesure un écart-type d'amélioration sur son benchmark de développeur junior.
  • Remplacement direct d'Opus 4, sans changement de prix.

Anthropic publie Claude Opus 4.1, mise à jour d'Opus 4 avec de meilleures performances en codage, en agents et en raisonnement, au même prix. L'éditeur recommande de migrer depuis Opus 4 pour tous les usages. ### Ce qui change - 74,5 % sur SWE-bench Verified, contre 72,5 % pour Opus 4. - Progrès notables en refactorisation multi-fichiers (retour de GitHub) et en recherche et suivi de détails. - Corrections plus précises dans de grandes bases de code, sans modifications inutiles (retour de Rakuten). - Windsurf mesure un écart-type d'amélioration sur son benchmark de développeur junior. - Remplacement direct d'Opus 4, sans changement de prix. ### Caractéristiques - Identifiant API : claude-opus-4-1-20250805 (retiré de l'API le 5 août 2026, encore disponible sur Bedrock et Google Cloud selon la page de tarifs). - Disponibilité : utilisateurs payants de Claude, Claude Code, API Anthropic, Amazon Bedrock, Google Cloud Vertex AI. - Contexte 200K et sortie 32K (source secondaire). Coupure des connaissances non communiquée. - Certains benchmarks utilisent la réflexion étendue avec un budget jusqu'à 64K tokens. ### Tarifs | Entrée (USD / M tokens) | Sortie (USD / M tokens) | Cache écriture 5 min | Cache lecture | Batch | |---|---|---|---|---| | 15 | 75 | 18,75 | 1,50 | 7,50 / 37,50 | ### Benchmarks | Benchmark | Score | |---|---| | SWE-bench Verified (sans réflexion étendue) | 74,5 % | | Terminal-Bench, GPQA Diamond, MMMLU, MMMU, AIME | dans un tableau image, chiffres non relevés | Scores publiés par l'éditeur. ### À retenir Mise à jour incrémentale et sans surcoût, à adopter en remplacement d'Opus 4 pour les usages de codage et d'agents.

Liens

Tags : LLM, Anthropic, Claude, Opus, Codage, Agents