Dimanche 9 août 2026 · édition en continu
Rechercher
STYNX
L'actualité de l'intelligence artificielle · sources primaires
Assistants & chatbots 11 juillet 2026 Veille IA

OpenAI éclate GPT-5 en trois modèles et lance la voix qui écoute en parlant

Sol, Terra, Luna : OpenAI redécoupe sa gamme phare par usage et budget, tandis que GPT-Live introduit une voix capable d'écouter et de répondre en même temps.

Illustration d'un assistant vocal IA avec ondes sonores en full-duplex
Photo : Jessica Lewis 🦋 thepaintedsquare / Pexels

Le 9 juillet 2026, OpenAI a mis fin à l'idée d'un modèle unique pour tout faire. Avec GPT-5.6, la firme découpe sa gamme en trois variants pensés pour des usages précis : Sol, Terra et Luna. Une fragmentation assumée, qui répond à une critique récurrente depuis le lancement de GPT-5.5, celle d'un modèle trop cher ou trop lent selon la tâche demandée.

Trois modèles, trois logiques économiques

Sol occupe le haut de gamme. C'est le modèle frontier, calibré pour le raisonnement complexe et les tâches agentic qui s'étendent sur plusieurs étapes, parfois plusieurs heures d'exécution autonome. Terra vise l'équilibre : OpenAI le positionne à des coûts deux fois inférieurs à GPT-5.5, pour les usages courants qui n'exigent pas la puissance de Sol. Luna, enfin, mise tout sur la vitesse et le prix, taillé pour les intégrations à fort volume où la latence compte plus que la finesse du raisonnement.

Cette segmentation par usage plutôt que par simple puissance brute traduit une évolution de fond : les entreprises qui déploient de l'IA à grande échelle ne veulent plus payer le tarif frontier pour des tâches simples. En proposant Terra à moitié prix, OpenAI répond directement à la pression tarifaire exercée par des concurrents plus légers sur les cas d'usage à faible complexité.

GPT-Live, la voix qui n'attend plus son tour

Le second pan de l'annonce concerne la voix, avec GPT-Live-1 et sa version mini. Jusqu'ici, les assistants vocaux fonctionnaient en half-duplex : l'utilisateur parle, le modèle attend la fin de la phrase, puis répond. GPT-Live introduit une architecture full-duplex, où le modèle écoute et parle simultanément, comme deux humains en conversation.

Concrètement, cela permet des relances de suivi minimalistes, du type « mhmm » ou « oui, continuez », sans interrompre le flux de parole de l'utilisateur. OpenAI décrit aussi un mécanisme de délégation transparente : quand une requête nécessite un raisonnement plus lourd, GPT-Live bascule silencieusement vers un modèle frontier en arrière-plan, sans rupture perceptible dans la conversation.

Pour l'instant, GPT-Live s'appuie sur GPT-5.5 comme backend. OpenAI précise que le système sera mis à jour en continu au fil des futurs modèles frontier, ce qui en fait moins un produit figé qu'une couche d'interaction destinée à évoluer indépendamment du modèle de raisonnement sous-jacent.

La délégation autonome au modèle frontier se fait « en arrière-plan », sans que l'utilisateur ait à choisir explicitement quel modèle traite sa requête.

ChatGPT Voice suit le mouvement

En parallèle, ChatGPT Voice reçoit plusieurs ajouts : intégration de la recherche web directement dans les échanges vocaux, gestion du bruit ambiant améliorée, et surtout un contrôle du niveau de raisonnement via trois paliers, Instant, Medium et High. L'utilisateur peut ainsi arbitrer lui-même entre réponse immédiate et réponse plus réfléchie, selon le contexte.

Cette granularité fait écho à la logique Sol/Terra/Luna : plutôt qu'un modèle qui décide seul de son effort de calcul, OpenAI donne la main à l'utilisateur ou au développeur pour choisir le compromis vitesse/qualité/coût adapté à chaque situation.

Ce que ça change pour les développeurs

Pour les équipes qui construisent sur l'API OpenAI, cette annonce change la donne côté architecture produit. Il ne s'agit plus de choisir un modèle unique pour toute une application, mais de router intelligemment les requêtes vers Sol, Terra ou Luna selon leur complexité, un peu comme on choisirait un serveur GPU adapté à la charge de calcul. Reste à voir comment les tarifs précis se déclineront à l'usage, et si cette fragmentation ne complexifie pas, en pratique, l'expérience d'intégration pour les développeurs les moins aguerris.

Sources

  1. OpenAI Newsroom - Introducing GPT-Live
  2. OpenAI Blog - ChatGPT is now a partner for your most ambitious work

Stynx s'appuie exclusivement sur des sources primaires officielles. Notre méthodologie & sourcing.

À lire aussi

Commentaires

Soyez le premier à réagir.