Claude Sonnet 4

2025-05-22 · Éditeur : Anthropic · Domaine : Intelligence Artificielle

Anthropic lance Claude Sonnet 4, mise à niveau majeure de Sonnet 3.7 avec de meilleures capacités de codage et de suivi des consignes, au même prix, et accessible aux utilisateurs gratuits.

Ce qui change

  • 72,7 % sur SWE-bench Verified, contre 63,7 % pour Sonnet 3.7 : équilibre entre capacité et efficacité pour un déploiement large.
  • Réflexion étendue avec usage d'outils (bêta), exécution d'outils en parallèle, meilleur suivi des consignes.
  • Réduction de 65 % des comportements de contournement (raccourcis) sur les tâches agentiques par rapport à Sonnet 3.7.
  • Disponible pour les utilisateurs gratuits de Claude.ai, contrairement à Opus 4.
  • Compléments ultérieurs : contexte de 1 million de tokens en bêta sur Sonnet 4 depuis le 12 août 2025 (tarif majoré au-delà de 200K tokens).

Anthropic lance Claude Sonnet 4, mise à niveau majeure de Sonnet 3.7 avec de meilleures capacités de codage et de suivi des consignes, au même prix, et accessible aux utilisateurs gratuits. ### Ce qui change - 72,7 % sur SWE-bench Verified, contre 63,7 % pour Sonnet 3.7 : équilibre entre capacité et efficacité pour un déploiement large. - Réflexion étendue avec usage d'outils (bêta), exécution d'outils en parallèle, meilleur suivi des consignes. - Réduction de 65 % des comportements de contournement (raccourcis) sur les tâches agentiques par rapport à Sonnet 3.7. - Disponible pour les utilisateurs gratuits de Claude.ai, contrairement à Opus 4. - Compléments ultérieurs : contexte de 1 million de tokens en bêta sur Sonnet 4 depuis le 12 août 2025 (tarif majoré au-delà de 200K tokens). ### Caractéristiques - Identifiant API : claude-sonnet-4-20250514 (retiré de l'API le 15 juin 2026). - Disponibilité : Claude.ai (dont offre gratuite), API Anthropic, Amazon Bedrock, Google Cloud Vertex AI. - Fenêtre de contexte 200K tokens à l'origine (source secondaire), sortie maximale 64K (source secondaire), coupure des connaissances non communiquée dans l'annonce. - Modalités : texte et images en entrée, texte en sortie. ### Tarifs | Entrée (USD / M tokens) | Sortie (USD / M tokens) | Cache écriture 5 min | Cache lecture | Batch | |---|---|---|---|---| | 3 | 15 | 3,75 | 0,30 | 1,50 / 7,50 | Le montant du palier long contexte (au-delà de 200K tokens) n'a pas été vérifié. ### Benchmarks | Benchmark | Claude Opus 4 | Claude Sonnet 4 | |---|---|---| | SWE-bench Verified | 72,5 % | 72,7 % | | SWE-bench (calcul élevé) | 79,4 % | 80,2 % | | Terminal-bench | 43,2 % | non repris | | GPQA Diamond (réflexion étendue) | 75,8 % | 71,4 % | | MMMLU (réflexion étendue) | 88,0 % | 85,8 % | | MMMU (réflexion étendue) | 74,6 % | 73,3 % | | AIME (réflexion étendue) | 34,5 % | 33,5 % | Scores publiés par l'éditeur. ### À retenir Sonnet 4 conserve le prix de Sonnet 3.7 tout en gagnant environ 9 points sur SWE-bench Verified, ce qui en fait le modèle par défaut pour le codage à grande échelle de la gamme 4.

Liens

Tags : LLM, Anthropic, Claude, Sonnet, Codage, Agents