Qwen3.5

2026-02-16 · Éditeur : Alibaba · Domaine : Intelligence Artificielle

Alibaba lance Qwen3.5, génération multimodale native dont le fleuron à poids ouverts Qwen3.5-397B-A17B (17 milliards de paramètres actifs) sous Apache 2.0, décliné ensuite de 0,8B à 122B.

Ce qui change

  • Fondation vision-langage unifiée : entraînement par fusion précoce sur des tokens multimodaux ; l'éditeur annonce la parité avec Qwen3 en texte et de meilleurs résultats que Qwen3-VL en vision.
  • Architecture hybride : Gated DeltaNet (attention linéaire) combinée à un MoE éparse, pour un débit élevé et une latence réduite.
  • Couverture linguistique étendue à 201 langues et dialectes (annonce de l'éditeur).
  • Famille complète en quelques jours : 397B-A17B (16 février), puis 122B-A10B, 35B-A3B et 27B (24 février), puis 9B, 4B, 2B et 0,8B (26 au 28 février), dates de mise en ligne sur Hugging Face.
  • Version hébergée Qwen3.5-Plus : contexte de 1M tokens par défaut, outils intégrés, usage adaptatif d'outils.

Alibaba lance Qwen3.5, génération multimodale native dont le fleuron à poids ouverts Qwen3.5-397B-A17B (17 milliards de paramètres actifs) sous Apache 2.0, décliné ensuite de 0,8B à 122B. ### Contexte Qwen3 (2025) séparait encore les modèles de texte et de vision (Qwen3-VL). Face à GPT-5.2, Claude 4.5 Opus et Gemini 3 Pro, les meilleurs modèles fermés gardaient une avance sur la plupart des tests agentiques. Qwen3.5 vise à rapprocher l'ouvert des fermés avec un seul modèle multimodal, et sort en même temps que Qwen3.5-Plus, la version hébergée (propriétaire côté service) correspondant au même modèle. ### Ce que le modèle apporte - Fondation vision-langage unifiée : entraînement par fusion précoce sur des tokens multimodaux ; l'éditeur annonce la parité avec Qwen3 en texte et de meilleurs résultats que Qwen3-VL en vision. - Architecture hybride : Gated DeltaNet (attention linéaire) combinée à un MoE éparse, pour un débit élevé et une latence réduite. - Couverture linguistique étendue à 201 langues et dialectes (annonce de l'éditeur). - Famille complète en quelques jours : 397B-A17B (16 février), puis 122B-A10B, 35B-A3B et 27B (24 février), puis 9B, 4B, 2B et 0,8B (26 au 28 février), dates de mise en ligne sur Hugging Face. - Version hébergée Qwen3.5-Plus : contexte de 1M tokens par défaut, outils intégrés, usage adaptatif d'outils. ### Architecture et caractéristiques - Qwen3.5-397B-A17B : 397B au total, 17B actifs ; 60 couches ; disposition 15 x (3 x (Gated DeltaNet puis MoE) puis 1 x (Gated Attention puis MoE)) ; 512 experts, 10 routés plus 1 partagé. - Contexte : 262 144 tokens en natif, extensible jusqu'à 1 010 000. - Modalités : texte, image, vidéo en entrée ; texte en sortie. - Licence : Apache 2.0, sans clause d'utilisateurs actifs. - Poids : Hugging Face, Qwen/Qwen3.5-397B-A17B (variantes FP8 et GPTQ-Int4 publiées). Date de coupure : non communiquée. ### Coût et accès | Élément | Valeur | |---|---| | Qwen3.5-Plus, API officielle, entrée (USD / M tokens) | 0,4 | | Qwen3.5-Plus, API officielle, sortie (USD / M tokens) | 2,4 | | Cache explicite (création / lecture) | 0,5 / 0,04 | | Auto-hébergement | Non communiqué ; les poids FP8 et GPTQ-Int4 existent pour réduire la mémoire | Tarifs relevés sur la page Qwen Cloud consultée le 2026-09-29, pas nécessairement ceux du lancement. ### Benchmarks | Test | GPT5.2 | Claude 4.5 Opus | Gemini-3 Pro | Qwen3.5-397B-A17B | |---|---|---|---|---| | GPQA | 92,4 | 87,0 | 91,9 | 88,4 | | MMLU-Pro | 87,4 | 89,5 | 89,8 | 87,8 | | IFBench | 75,4 | 58,0 | 70,4 | 76,5 | | SWE-bench Verified | 80,0 | 80,9 | 76,2 | 76,4 | | Terminal Bench 2 | 54,0 | 59,3 | 54,2 | 52,5 | | LiveCodeBench v6 | 87,7 | 84,8 | 90,7 | 83,6 | | BFCL-V4 | 63,1 | 77,5 | 72,5 | 72,9 | Source : model card Hugging Face de Qwen3.5-397B-A17B, scores mesurés et publiés par l'éditeur. ### Face aux modèles fermés Sur ce tableau, Qwen3.5 est devant les trois modèles fermés cités sur IFBench (76,5 contre 75,4 pour GPT5.2) et devant Claude 4.5 Opus et Gemini 3 Pro sur GPQA sans dépasser GPT5.2. Il reste en retrait sur SWE-bench Verified (76,4 contre 80,9 pour Claude 4.5 Opus) et sur Terminal Bench 2 (52,5 contre 59,3). L'écart de code agentique subsiste donc de quelques points face au meilleur modèle fermé de la période, Claude 4.5 Opus étant alors, dans ce tableau, le plus fort sur le code. Côté prix, la version hébergée Qwen3.5-Plus est facturée 0,4 USD en entrée et 2,4 USD en sortie par million de tokens (page consultée en septembre 2026), et l'éditeur laisse en plus les poids en Apache 2.0. Pour un choix ouvert ou fermé, cela offre une option auto-hébergeable sans redevance, avec un compromis chiffré de quelques points sur le code agentique. ### À retenir Qwen3.5 marque le passage de Qwen à un modèle unique multimodal et hybride, avec une gamme complète sous Apache 2.0. Il place l'ouvert à quelques points des modèles fermés de février 2026 sur la plupart des tests publiés.

Liens

Tags : LLM, Open Source, Alibaba, Qwen, Apache 2.0, MoE, Multimodal, Vision