# OpenAI ressuscite ses modèles à poids ouverts avec gpt-oss

> OpenAI a publié gpt-oss-120b et gpt-oss-20b le 9 août 2025, ses premiers modèles à poids ouverts depuis GPT-2 en 2019.

Type : Actualité IA · Catégorie : Outils · Publié le 2026-08-24 · Signal IA - Order & Chaos
Source : https://www.orderchaos.eu/signal-ia/actu/openai-relance-les-modeles-a-poids-ouverts-avec-gpt-oss
Tags : openai, modèles ouverts, transformer, gpt-oss, infrastructure, open-source

---

## En résumé

- OpenAI a publié gpt-oss-120b et gpt-oss-20b le 9 août 2025.
- Les deux modèles sont les premiers modèles à poids ouverts d’OpenAI depuis GPT-2 en 2019.
- Le modèle gpt-oss-20b fonctionne sur un GPU grand public doté de 16 Go de mémoire vive.

**Le signal :** OpenAI revient aux modèles à poids ouverts avec gpt-oss-20b et gpt-oss-120b, capables de fonctionner sur du matériel différent.

**Publication datée** OpenAI a publié [gpt-oss](/signal-ia/actu/openai-lance-gpt-oss-apres-gpt-2)-120b et gpt-oss-20b le 9 août 2025. Ces deux modèles sont ses premiers modèles à poids ouverts depuis GPT-2, publié en 2019. Le titre de l’analyse de Sebastian Raschka examine les évolutions architecturales entre GPT-2 et gpt-oss. Les deux modèles gpt-oss sont des grands modèles de langage à décodeur uniquement. Ils reposent sur l’architecture Transformer. Cette publication établit donc une continuité entre la famille GPT-2 et les modèles gpt-oss. La date de sortie et le statut de modèles à poids ouverts sont documentés dans [l’analyse originale de Sebastian Raschka](https://magazine.sebastianraschka.com/p/from-gpt-2-to-gpt-oss-analyzing-the).

**Retour aux poids ouverts** GPT-2 constitue le précédent cité pour les modèles à poids ouverts d’[OpenAI](/signal-ia/actu/anthropic-et-openai-la-resilience-prime-sur-la-vitesse). L’entreprise n’avait pas publié de modèle à poids ouverts depuis 2019, selon les faits fournis. Le retour intervient avec deux tailles distinctes, 20 milliards et 120 milliards de paramètres selon leurs noms. Le paquet factuel ne fournit pas d’autres mesures de performance ou de calendrier. Il ne permet donc pas d’attribuer un avantage comparatif à l’un des modèles. Il établit seulement leur date de publication, leur lien historique avec GPT-2 et leur appartenance aux modèles à poids ouverts. Les informations disponibles sont également associées au [modèle gpt-oss-20b sur Hugging Face](https://huggingface.co/openai/gpt-oss-20b).

## Les deux modèles ciblent différents matériels

**Capacité matérielle** Le modèle gpt-oss-20b peut fonctionner sur un GPU grand public disposant de 16 Go de mémoire vive au maximum. Le modèle gpt-oss-120b peut fonctionner sur un seul H100 doté de 80 Go de mémoire vive. Le paquet précise aussi que du matériel plus récent peut accueillir le modèle 120b. Ces indications décrivent des conditions matérielles annoncées pour l’exécution des deux modèles. Elles ne mesurent ni leur vitesse, ni leur coût, ni leur qualité de réponse. Elles distinguent toutefois clairement les exigences mentionnées pour gpt-oss-20b et gpt-oss-120b. Le premier vise un GPU grand public jusqu’à 16 Go, tandis que le second est associé à un H100 de 80 Go.

**Architecture commune** Les modèles gpt-oss sont des grands modèles de langage à décodeur uniquement. Ils sont construits sur l’architecture [Transformer](/signal-ia/actu/discoformer-revolutionne-lanalyse-de-densite). Cette description architecturale s’applique aux deux modèles publiés par OpenAI le 9 août 2025. Le paquet ne fournit pas de détail supplémentaire sur leurs blocs, leurs mécanismes d’attention ou leur entraînement. Il indique cependant que l’analyse compare gpt-oss à GPT-2. GPT-2 appartient au précédent historique cité pour les modèles à poids ouverts d’OpenAI, en 2019. La comparaison porte donc sur une série de modèles séparés par cette période, tout en restant limitée ici aux éléments architecturaux explicitement documentés.

## Le dropout recule depuis GPT-2

**Évolution du dropout** Le dropout est rarement utilisé dans les grands modèles de langage modernes. La plupart des modèles publiés après GPT-2 l’ont supprimé, selon le paquet factuel. Cette information situe GPT-2 comme point de comparaison dans l’évolution de cette pratique. Elle ne précise pas si gpt-oss-20b ou gpt-oss-120b utilisent encore du dropout. Aucune conclusion spécifique sur leur configuration ne peut donc être établie à partir des faits fournis. Les éléments confirmés restent leur date de publication, leur architecture Transformer à décodeur uniquement et leurs exigences matérielles distinctes. L’analyse complète est disponible dans [l’article de Sebastian Raschka](https://magazine.sebastianraschka.com/p/from-gpt-2-to-gpt-oss-analyzing-the), consacré au passage de GPT-2 à gpt-oss.
