Qwen3-Coder

2025-07-22 · Éditeur : Alibaba · Domaine : Intelligence Artificielle

Alibaba Qwen publie Qwen3-Coder-480B-A35B-Instruct, un MoE de 480 milliards de paramètres (35 milliards actifs) sous Apache 2.0, dédié au code agentique, avec l'outil en ligne de commande Qwen Code.

Ce qui change

  • Pré-entraînement sur 7 500 milliards de tokens, dont 70 % de code, avec réécriture des données bruitées par Qwen2.5-Coder.
  • Contexte natif de 256 000 tokens, extensible à 1 million avec YaRN, pensé pour les dépôts entiers et les pull requests.
  • Apprentissage par renforcement sur le code (« difficile à résoudre, facile à vérifier ») puis renforcement agentique long, avec 20 000 environnements indépendants en parallèle sur l'infrastructure d'Alibaba Cloud.
  • Résultats annoncés comme état de l'art parmi les modèles ouverts sur SWE-Bench Verified sans mise à l'échelle au test, et comparables à Claude Sonnet 4 selon l'éditeur.
  • Outil Qwen Code, dérivé de Gemini CLI, et compatibilité avec Claude Code, Cline via un format d'appel de fonctions dédié.

Alibaba Qwen publie Qwen3-Coder-480B-A35B-Instruct, un MoE de 480 milliards de paramètres (35 milliards actifs) sous Apache 2.0, dédié au code agentique, avec l'outil en ligne de commande Qwen Code. ### Contexte Mi-2025, les agents de code (Claude Code, Gemini CLI) reposent sur des modèles capables d'enchaîner de nombreux appels d'outils. L'éditeur compare Qwen3-Coder à Claude Sonnet 4 et le présente comme « le plus agentique » de ses modèles de code. ### Ce que le modèle apporte - Pré-entraînement sur 7 500 milliards de tokens, dont 70 % de code, avec réécriture des données bruitées par Qwen2.5-Coder. - Contexte natif de 256 000 tokens, extensible à 1 million avec YaRN, pensé pour les dépôts entiers et les pull requests. - Apprentissage par renforcement sur le code (« difficile à résoudre, facile à vérifier ») puis renforcement agentique long, avec 20 000 environnements indépendants en parallèle sur l'infrastructure d'Alibaba Cloud. - Résultats annoncés comme état de l'art parmi les modèles ouverts sur SWE-Bench Verified sans mise à l'échelle au test, et comparables à Claude Sonnet 4 selon l'éditeur. - Outil Qwen Code, dérivé de Gemini CLI, et compatibilité avec Claude Code, Cline via un format d'appel de fonctions dédié. ### Architecture et caractéristiques MoE de 480 milliards de paramètres au total et 35 milliards actifs, 62 couches, 160 experts dont 8 actifs, GQA 96 têtes de requête pour 8 de clé-valeur. Mode non-réflexion uniquement. Contexte natif 262 144 tokens. Licence Apache 2.0. Poids sur Hugging Face et ModelScope. Des versions plus petites ont suivi, dont Qwen3-Coder-30B-A3B (31 juillet 2025). Date de coupure : non communiquée. ### Coût et accès | Palier de contexte (qwen3-coder-plus, API Alibaba Cloud, tarif actuel consulté) | Entrée | Sortie | |---|---|---| | 0 à 32 K tokens | 1 $ | 5 $ | | 32 à 128 K | 1,8 $ | 9 $ | | 128 à 256 K | 3 $ | 15 $ | | 256 K à 1 M | 6 $ | 60 $ | Prix par million de tokens, USD. Matériel d'auto-hébergement non communiqué par l'éditeur. ### Benchmarks Les comparaisons (SWE-Bench Verified, Terminal-Bench, tâches agentiques) figurent sous forme de graphiques image dans le billet et la fiche modèle ; aucun tableau chiffré en texte n'a été retrouvé. Aucune valeur n'est donc reproduite ici. ### Face aux modèles fermés L'éditeur affirme que Qwen3-Coder obtient des résultats comparables à Claude Sonnet 4 sur le code agentique, l'usage de navigateur et l'usage d'outils, et fixe un nouvel état de l'art parmi les modèles ouverts sur SWE-Bench Verified. Ces affirmations reposent sur des graphiques de l'éditeur, dont les valeurs n'ont pas pu être vérifiées en texte. Sur le plan des coûts, l'API de l'éditeur est tarifée par paliers de contexte, avec une sortie à 5 dollars par million de tokens pour les petites requêtes, sans comparaison sourcée avec les API fermées ici. Le modèle complet de 480 milliards de paramètres exige une infrastructure multi-GPU, ce qui limite l'auto-hébergement, mais la licence Apache 2.0 autorise l'usage commercial sans restriction. ### À retenir Qwen3-Coder est le jalon où Qwen entre sur le terrain des agents de code avec un modèle et un outil ouverts. Les chiffres de comparaison restent à vérifier dans les graphiques de l'éditeur.

Liens

Tags : LLM, Open Source, Alibaba, Qwen, MoE, Apache 2.0, Code