gpt-oss-120b et gpt-oss-20b

2025-08-05 · Éditeur : OpenAI · Domaine : Intelligence Artificielle

OpenAI publie gpt-oss-120b et gpt-oss-20b, ses premiers modèles de langage à poids ouverts depuis GPT-2, sous licence Apache 2.0, conçus pour le raisonnement, l'usage d'outils et un déploiement sur du matériel courant.

Ce qui change

  • gpt-oss-120b atteint une quasi-parité avec o4-mini sur les benchmarks de raisonnement et tient sur un seul GPU de 80 Go.
  • gpt-oss-20b fournit des résultats proches d'o3-mini et fonctionne avec 16 Go de mémoire, y compris sur des appareils locaux.
  • Effort de raisonnement réglable (faible, moyen, élevé), chaîne de pensée complète non supervisée, appel de fonctions, navigation web, exécution Python et sorties structurées.
  • Poids téléchargeables et personnalisables (réglage fin), déployables sur site pour la confidentialité des données.

OpenAI publie gpt-oss-120b et gpt-oss-20b, ses premiers modèles de langage à poids ouverts depuis GPT-2, sous licence Apache 2.0, conçus pour le raisonnement, l'usage d'outils et un déploiement sur du matériel courant. ### Ce qui change - gpt-oss-120b atteint une quasi-parité avec o4-mini sur les benchmarks de raisonnement et tient sur un seul GPU de 80 Go. - gpt-oss-20b fournit des résultats proches d'o3-mini et fonctionne avec 16 Go de mémoire, y compris sur des appareils locaux. - Effort de raisonnement réglable (faible, moyen, élevé), chaîne de pensée complète non supervisée, appel de fonctions, navigation web, exécution Python et sorties structurées. - Poids téléchargeables et personnalisables (réglage fin), déployables sur site pour la confidentialité des données. ### Caractéristiques - Architecture Transformer à mélange d'experts : 117 milliards de paramètres au total et 5,1 milliards actifs par token pour le 120b ; 21 milliards et 3,6 milliards pour le 20b. - Contexte natif jusqu'à 128 000 tokens, entrée et sortie texte, coupure juin 2024, quantification MXFP4. - Disponibilité : Hugging Face, Azure, AWS, Databricks, Ollama, vLLM, LM Studio, Cloudflare, OpenRouter et autres ; pas d'API OpenAI à l'annonce. - Compatibles avec l'API Responses ; nouveau tokenizer o200k_harmony publié. ### Tarifs Poids libres sous licence Apache 2.0, sans tarif OpenAI. Le coût dépend du matériel ou de l'hébergeur choisi. ### Benchmarks Scores publiés par l'éditeur : le billet indique en termes qualitatifs que gpt-oss-120b égale ou dépasse o4-mini sur Codeforces, MMLU, HLE et TauBench, et le dépasse sur HealthBench et AIME 2024 et 2025. Les valeurs sont dans des graphiques, non reprises ici. ### À retenir Ces modèles offrent une option souveraine et auto-hébergée pour des cas d'usage à données sensibles. OpenAI précise que les modèles de sa plateforme restent la meilleure option pour le multimodal et les outils intégrés.

Liens

Tags : Open Source, LLM, OpenAI, gpt-oss, Raisonnement, Apache 2.0