GPT-Realtime-1.5

2026-02-23 · Éditeur : OpenAI · Domaine : Intelligence Artificielle

OpenAI publie GPT-Realtime-1.5 dans l'API Realtime, son modèle audio phare pour les agents vocaux et le support client, avec gpt-audio-1.5 pour l'API Chat Completions.

Ce qui change

  • Modèle parole à parole natif, sans chaîne transcription, texte et synthèse vocale.
  • Entrée texte, audio et image ; sortie texte et audio.
  • gpt-audio-1.5 apporte les entrées et sorties audio à l'API Chat Completions.
  • Successeur de la génération gpt-realtime, suivi en mai par GPT-Realtime-2.

OpenAI publie GPT-Realtime-1.5 dans l'API Realtime, son modèle audio phare pour les agents vocaux et le support client, avec gpt-audio-1.5 pour l'API Chat Completions. ### Ce qui change - Modèle parole à parole natif, sans chaîne transcription, texte et synthèse vocale. - Entrée texte, audio et image ; sortie texte et audio. - gpt-audio-1.5 apporte les entrées et sorties audio à l'API Chat Completions. - Successeur de la génération gpt-realtime, suivi en mai par GPT-Realtime-2. ### Caractéristiques - GPT-Realtime-1.5 : contexte 32 000 tokens, sortie maximale 4 096 tokens, coupure des connaissances 30 septembre 2024. - gpt-audio-1.5 : contexte 128 000 tokens, sortie maximale 16 384 tokens. - Disponibilité : API Realtime (v1/realtime) et Chat Completions. - Identifiants : gpt-realtime-1.5, gpt-audio-1.5. ### Tarifs | Modèle | Modalité | Entrée | Entrée en cache | Sortie | | --- | --- | --- | --- | --- | | gpt-realtime-1.5 | Texte | 4,00 $ | 0,40 $ | 16,00 $ | | gpt-realtime-1.5 | Audio | 32,00 $ | 0,40 $ | 64,00 $ | | gpt-realtime-1.5 | Image | 5,00 $ | 0,50 $ | n.c. | | gpt-audio-1.5 | Texte | 2,50 $ | n.c. | 10,00 $ | | gpt-audio-1.5 | Audio | 32,00 $ | n.c. | 64,00 $ | Prix par million de tokens (USD), lus sur les fiches modèles. ### Benchmarks Aucun score chiffré publié par l'éditeur dans l'annonce. ### À retenir Mise à jour de la couche voix de l'API, sans billet dédié. Elle sert surtout de point de comparaison avec GPT-Realtime-2 et 2.1.

Liens

Tags : Audio, OpenAI, Realtime, Voix, Agent vocal