o3-mini

2025-01-31 · Éditeur : OpenAI · Domaine : Intelligence Artificielle

OpenAI lance o3-mini, son modèle de raisonnement compact le plus économique, optimisé pour les sciences, les mathématiques et le code, disponible dans ChatGPT et l'API le jour même.

Ce qui change

  • Premier petit modèle de raisonnement d'OpenAI avec appel de fonctions, sorties structurées et messages développeur.
  • Trois niveaux d'effort de raisonnement (low, medium, high) ; o3-mini-high est proposé dans ChatGPT aux abonnés payants.
  • Remplace o1-mini dans ChatGPT, avec une limite portée de 50 à 150 messages par jour pour Plus et Team.
  • Première fois qu'un modèle de raisonnement est accessible aux utilisateurs gratuits (option « Reason »).
  • Recherche web intégrée en prototype.

OpenAI lance o3-mini, son modèle de raisonnement compact le plus économique, optimisé pour les sciences, les mathématiques et le code, disponible dans ChatGPT et l'API le jour même. ### Ce qui change - Premier petit modèle de raisonnement d'OpenAI avec appel de fonctions, sorties structurées et messages développeur. - Trois niveaux d'effort de raisonnement (low, medium, high) ; o3-mini-high est proposé dans ChatGPT aux abonnés payants. - Remplace o1-mini dans ChatGPT, avec une limite portée de 50 à 150 messages par jour pour Plus et Team. - Première fois qu'un modèle de raisonnement est accessible aux utilisateurs gratuits (option « Reason »). - Recherche web intégrée en prototype. ### Caractéristiques - Contexte 200 000 tokens, sortie maximale 100 000 tokens, entrée texte seule, sortie texte. - Date de coupure : 1er octobre 2023. - Identifiant API : o3-mini (snapshot o3-mini-2025-01-31), via Chat Completions, Responses et Batch. ### Tarifs Tarifs par million de tokens (USD), tels que listés dans la documentation API. | | Entrée | Entrée en cache | Sortie | | --- | --- | --- | --- | | o3-mini | 1,10 | 0,55 | 4,40 | ### Benchmarks Scores publiés par l'éditeur dans le texte de l'annonce (les autres résultats figurent dans des graphiques). | Mesure | Résultat | | --- | --- | | FrontierMath, effort high, avec Python | plus de 32 % au premier essai | | SWE-bench Verified, high, scaffold Agentless | 39 % | | SWE-bench Verified, high, scaffold interne | 61 % | | Préférence d'experts contre o1-mini | 56 % | | Erreurs majeures contre o1-mini | 39 % de moins | ### À retenir o3-mini rend le raisonnement accessible à faible coût, avec des réponses 24 % plus rapides qu'o1-mini (7,7 s contre 10,16 s en moyenne). Il convient aux usages techniques à volume élevé.

Liens

Tags : LLM, OpenAI, o-series, Raisonnement, Mini