GPT-Live-1 (API)

2026-09-10 · Éditeur : OpenAI · Domaine : Intelligence Artificielle

OpenAI ouvre GPT-Live-1 dans l'API : un modèle vocal full-duplex qui écoute et parle en même temps, tarifé 0,05 $ la minute, avec délégation du raisonnement à un modèle texte.

Ce qui change

  • Un seul modèle gère l'écoute et la parole, sans chaîne transcription, raisonnement et synthèse.
  • Délégation du raisonnement et des appels d'outils à un modèle de backend (GPT-6 Astra, Luna, ou un modèle tiers).
  • Style, rythme et ton pilotables par le prompt système ; meilleure gestion du bruit et des silences.
  • Support de la téléphonie pour des agents vocaux par appel.
  • Transcriptions et texte de réponse natifs, biais par mots-clés.

OpenAI ouvre GPT-Live-1 dans l'API : un modèle vocal full-duplex qui écoute et parle en même temps, tarifé 0,05 $ la minute, avec délégation du raisonnement à un modèle texte. ### Ce qui change - Un seul modèle gère l'écoute et la parole, sans chaîne transcription, raisonnement et synthèse. - Délégation du raisonnement et des appels d'outils à un modèle de backend (GPT-6 Astra, Luna, ou un modèle tiers). - Style, rythme et ton pilotables par le prompt système ; meilleure gestion du bruit et des silences. - Support de la téléphonie pour des agents vocaux par appel. - Transcriptions et texte de réponse natifs, biais par mots-clés. ### Caractéristiques - Entrée et sortie audio et texte ; images non prises en charge. - Coupure des connaissances : 31 juillet 2025. - Disponibilité : API (v1/live/sessions). - Identifiant : gpt-live-1. L'usage du modèle de backend est facturé à part. ### Tarifs | Élément | Tarif | | --- | --- | | Session vocale gpt-live-1 | 0,05 $ par minute, facturée à la seconde | | Modèle de backend et outils | Facturés séparément aux tarifs du modèle choisi | ### Benchmarks | Mesure | Résultat | | --- | --- | | Full Duplex Bench, gain vs GPT-Realtime-2.1 | +30 points | | Interruptions chez Speak, vs systèmes par tours | -80 % environ | Scores publiés par l'éditeur. Le billet indique aussi un classement n°1 sur Tau3 avec Astra en backend. ### À retenir Le coût de la couche voix devient prévisible (par minute) et indépendant du modèle de raisonnement, qu'on peut choisir selon la difficulté du cas.

Liens

Tags : Audio, OpenAI, Voix, Full-duplex, API