Claude Sonnet 4.5

2025-09-29 · Éditeur : Anthropic · Domaine : Intelligence Artificielle

Anthropic lance Claude Sonnet 4.5, présenté comme son meilleur modèle de codage et d'agents, capable de rester concentré plus de 30 heures. Le Claude Agent SDK est publié le même jour.

Ce qui change

  • 77,2 % sur SWE-bench Verified et 61,4 % sur OSWorld (usage d'ordinateur).
  • Autonomie annoncée de plus de 30 heures sur des tâches complexes en plusieurs étapes.
  • Claude Agent SDK, sur la même infrastructure que Claude Code, points de contrôle dans Claude Code et extension VS Code native.
  • Édition de contexte et outil de mémoire pour les agents de longue durée.
  • Modèle décrit comme le plus aligné publié à ce jour, avec une meilleure résistance à l'injection de prompt.

Anthropic lance Claude Sonnet 4.5, présenté comme son meilleur modèle de codage et d'agents, capable de rester concentré plus de 30 heures. Le Claude Agent SDK est publié le même jour. ### Ce qui change - 77,2 % sur SWE-bench Verified et 61,4 % sur OSWorld (usage d'ordinateur). - Autonomie annoncée de plus de 30 heures sur des tâches complexes en plusieurs étapes. - Claude Agent SDK, sur la même infrastructure que Claude Code, points de contrôle dans Claude Code et extension VS Code native. - Édition de contexte et outil de mémoire pour les agents de longue durée. - Modèle décrit comme le plus aligné publié à ce jour, avec une meilleure résistance à l'injection de prompt. ### Caractéristiques - Identifiant API : claude-sonnet-4-5-20250929 (alias claude-sonnet-4-5). - Contexte 200K tokens, sortie maximale 64K tokens. Coupure fiable des connaissances : janvier 2025 ; données d'entraînement jusqu'en juillet 2025 (documentation). - Réflexion étendue manuelle. Texte et images en entrée, texte en sortie. - Disponibilité : apps Claude, API, Claude Code, Amazon Bedrock, Google Cloud Vertex AI. ### Tarifs | Entrée (USD / M tokens) | Sortie (USD / M tokens) | Cache écriture 5 min / 1 h | Cache lecture | Batch | |---|---|---|---|---| | 3 | 15 | 3,75 / 6 | 0,30 | 1,50 / 7,50 | Prix inchangé par rapport à Sonnet 4. ### Benchmarks | Benchmark | Score | |---|---| | SWE-bench Verified | 77,2 % (contexte 200K) | | SWE-bench Verified, configuration 1M de contexte | 78,2 % | | SWE-bench Verified, calcul élevé | 82,0 % | | OSWorld | 61,4 % | Scores publiés par l'éditeur ; le tableau comparatif complet est une image non relevée. ### À retenir Sonnet 4.5 remonte la performance de codage de la gamme au prix de Sonnet 4, et l'Agent SDK ouvre la construction d'agents sur le même socle que Claude Code.

Liens

Tags : LLM, Anthropic, Claude, Sonnet, Agents, Codage, Agent SDK