OpenAI : agents vocaux accélérés avec GPT-Realtime-2.1
3 min · 7 juillet 2026

OpenAI : agents vocaux accélérés avec GPT-Realtime-2.1

Par Arthur Dekeyser

En résumé

1

OpenAI lance GPT-Realtime-2.1 et GPT-Realtime-2.1-mini dans l'API.

2

Réduction de la latence p95 d'au moins 25% grâce au caching amélioré.

3

Les modèles ciblent les applications d'agents vocaux à faible latence.

💡

Le signal : OpenAI coupe la latence p95 de 25% avec ses modèles Realtime.

RAPPORT STRATÉGIQUE

Vous appréciez ce genre d'analyse ?

Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Gratuit, sans engagement.

+11 000 fondateurs

OpenAI ajoute deux nouveaux modèles Realtime à son API. Les modèles GPT-Realtime-2.1 et GPT-Realtime-2.1-mini sont conçus pour les agents vocaux avec une latence réduite. Le modèle mini intègre des capacités de raisonnement adaptées pour la voix.

Avant l’introduction de ces modèles, OpenAI proposait déjà des solutions pour la voix, mais avec certaines limitations de latence. La mise à jour inclut une réduction d’au moins 25% de la latence p95 grâce à des améliorations du caching. Cela favorise une intégration plus fluide des applications vocales.

Les modèles GPT-Realtime-2.1 sont disponibles via l’API d’OpenAI. Le modèle mini suit la tarification du précédent GPT-Realtime-mini. Il s’adresse spécifiquement aux applications nécessitant un traitement rapide de la voix.

Les implications techniques incluent des connexions efficaces via WebRTC pour de meilleures performances des agents vocaux. Les améliorations de latence positionnent ces modèles comme des solutions de choix pour les développeurs cherchant à intégrer des fonctionnalités vocales avancées dans leurs produits.

OpenAI continue d’améliorer ses offres en matière de modèle de langage, ciblant spécifiquement les besoins croissants des applications basées sur la voix et ancrées dans des contextes d’utilisation en temps réel.

Gardez un coup d'avance en IA et tech.

Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Zéro spam.

+11 000 fondateurs

À lire aussi