Claude Opus 4
2025-05-22 · Éditeur : Anthropic · Domaine : Intelligence Artificielle
Anthropic lance Claude Opus 4, présenté comme son meilleur modèle de codage, capable de tâches longues sur des milliers d'étapes. Il sort avec Claude Sonnet 4 et la disponibilité générale de Claude Code.
Ce qui change
- Positionné comme le modèle le plus performant de la gamme en codage (72,5 % sur SWE-bench Verified, 43,2 % sur Terminal-bench).
- Travail soutenu sur des tâches longues : Rakuten cite une exécution autonome de 7 heures.
- Réflexion étendue avec usage d'outils (bêta), exécution d'outils en parallèle, meilleur suivi des consignes.
- Capacités de mémoire : avec un accès local aux fichiers, le modèle crée et maintient des fichiers de mémoire.
- Nouveautés API au lancement : outil d'exécution de code, connecteur MCP, Files API, cache de prompt jusqu'à une heure.
Anthropic lance Claude Opus 4, présenté comme son meilleur modèle de codage, capable de tâches longues sur des milliers d'étapes. Il sort avec Claude Sonnet 4 et la disponibilité générale de Claude Code. ### Ce qui change - Positionné comme le modèle le plus performant de la gamme en codage (72,5 % sur SWE-bench Verified, 43,2 % sur Terminal-bench). - Travail soutenu sur des tâches longues : Rakuten cite une exécution autonome de 7 heures. - Réflexion étendue avec usage d'outils (bêta), exécution d'outils en parallèle, meilleur suivi des consignes. - Capacités de mémoire : avec un accès local aux fichiers, le modèle crée et maintient des fichiers de mémoire. - Nouveautés API au lancement : outil d'exécution de code, connecteur MCP, Files API, cache de prompt jusqu'à une heure. ### Caractéristiques - Identifiant API : claude-opus-4-20250514 (retiré de l'API le 15 juin 2026). - Disponibilité : Claude.ai (Pro, Max, Team, Enterprise), API Anthropic, Amazon Bedrock, Google Cloud Vertex AI. - Fenêtre de contexte, sortie maximale et coupure des connaissances : non communiquées dans l'annonce (contexte 200K et sortie 32K relevés dans des sources secondaires). - Modalités : texte et images en entrée, texte en sortie. ### Tarifs | Entrée (USD / M tokens) | Sortie (USD / M tokens) | Cache écriture 5 min | Cache lecture | Batch | |---|---|---|---|---| | 15 | 75 | 18,75 | 1,50 | 7,50 / 37,50 | Les tarifs de cache et de batch proviennent de la page de tarifs actuelle de la documentation. ### Benchmarks | Benchmark | Claude Opus 4 | Claude Sonnet 4 | |---|---|---| | SWE-bench Verified | 72,5 % | 72,7 % | | SWE-bench (calcul élevé) | 79,4 % | 80,2 % | | Terminal-bench | 43,2 % | non repris | | GPQA Diamond (réflexion étendue) | 75,8 % | 71,4 % | | MMMLU (réflexion étendue) | 88,0 % | 85,8 % | | MMMU (réflexion étendue) | 74,6 % | 73,3 % | | AIME (réflexion étendue) | 34,5 % | 33,5 % | Scores publiés par l'éditeur. ### À retenir Opus 4 vise les tâches de codage et d'agents de longue durée, avec un prix élevé (15 / 75 USD). Il sera remplacé à ce tarif par Opus 4.1 puis par Opus 4.5 à un tiers du prix.
Liens
Tags : LLM, Anthropic, Claude, Opus, Codage, Agents