Z.ai lance GLM-5.3-Flash à 57 points pour 0,09 dollar
#benchmark 3 min · 27 août 2026

Z.ai lance GLM-5.3-Flash à 57 points pour 0,09 dollar

Par Arthur Dekeyser

En résumé

1

Z.ai a lancé GLM-5.3-Flash avec 320 milliards de paramètres.

2

Le modèle dispose d’une fenêtre de contexte d’un million de jetons.

3

GLM-5.3-Flash coûte 0,09 dollar par tâche et obtient 57 points.

💡

Le signal : GLM-5.3-Flash atteint 57 points sur l’Intelligence Index pour 0,09 dollar par tâche.

NEWSLETTER BUSINESS & IA

Vous appréciez ce genre d'analyse ?

Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Gratuit, sans engagement.

+11 000 fondateurs abonnés

Z.ai a lancé GLM-5.3-Flash le 27 août 2026. Le modèle compte 320 milliards de paramètres. Sa fenêtre de contexte atteint un million de jetons. Z.ai annonce également un coût de 0,09 dollar par tâche. GLM-5.3-Flash a obtenu 57 points sur l’Intelligence Index. Le modèle GLM-5.3 atteint, lui, 60 points sur ce même indice. Ces résultats placent les deux modèles dans une comparaison directe sur cet indicateur. Z.ai présente GLM-5.3-Flash comme le premier modèle nativement multimodal de la série GLM-5. Cette caractéristique est attribuée à Z.ai. Le lancement combine donc une capacité de contexte élevée, une architecture de grande taille et un coût par tâche précisément chiffré.

Le modèle testé anonymement sous le nom « ox-alpha » sur OpenCode et OpenRouter. Il est ensuite devenu le modèle le plus populaire de la semaine sur ces deux plateformes. Ce classement repose sur les usages observés sur OpenCode et OpenRouter. Le test anonyme a donc précédé cette popularité hebdomadaire. GLM-5.3-Flash conserve un écart de trois points avec GLM-5.3 sur l’Intelligence Index. Son tarif par tâche reste fixé à 0,09 dollar. Les deux données permettent de comparer le modèle à sa version GLM-5.3, sans confondre leurs scores. Z.ai associe ainsi un modèle évalué à 57 points à une présence remarquée dans deux environnements de développement et d’accès aux modèles.

Z.ai aligne coût et matériel

L’efficacité matérielle de Z.ai et son coût par jeton sont au niveau des processeurs graphiques Nvidia, selon les faits établis pour ce lancement. Cette comparaison porte sur l’efficacité matérielle et le coût par jeton. Elle ne modifie pas les caractéristiques annoncées de GLM-5.3-Flash. Le modèle conserve ses 320 milliards de paramètres et sa fenêtre d’un million de jetons. Son coût par tâche est de 0,09 dollar. Z.ai a également servi 100 000 milliards de jetons par jour. Ce volume est associé à Z.ai, tandis que la comparaison matérielle concerne Nvidia. Ces chiffres décrivent simultanément l’efficience annoncée et l’échelle de service atteinte par l’entreprise.

Artificial Analysis estime que GLM-5.3-Flash s’ajoute à une liste croissante de modèles chinois ayant récemment exercé une forte pression sur les prix des fournisseurs occidentaux. Cette appréciation est attribuée à Artificial Analysis. Elle concerne le positionnement tarifaire des modèles chinois, dont GLM-5.3-Flash fait partie. Le prix communiqué pour ce modèle est de 0,09 dollar par tâche. Son score sur l’Intelligence Index est de 57 points. GLM-5.3 atteint 60 points. Z.ai a par ailleurs servi 100 000 milliards de jetons par jour. Ces éléments relient le coût annoncé, la mesure comparative et la capacité de service de Z.ai, sans transformer une appréciation en résultat mesuré.

GLM-5.3-Flash gagne en visibilité

Les tests anonymes sur OpenCode et OpenRouter ont donné à GLM-5.3-Flash le nom « ox-alpha ». Le modèle est ensuite devenu le plus populaire de la semaine sur ces deux plateformes. Z.ai a lancé GLM-5.3-Flash avec 320 milliards de paramètres et un million de jetons de contexte. Le coût annoncé reste de 0,09 dollar par tâche. Artificial Analysis attribue à ce lancement une contribution à la pression exercée sur les prix par des modèles chinois. Z.ai affirme aussi que le modèle est le premier modèle nativement multimodal de la série GLM-5. La publication de Z.ai présente ce modèle, tandis que The Decoder rapporte son lancement.

Gardez un coup d'avance en IA et tech.

Chaque mardi et vendredi, l'essentiel en business & IA décryptées en 5 minutes. Zéro spam.

+11 000 fondateurs abonnés

À lire aussi