luca100

Z.ai (Zhipu) · Chine

GLM 5.3 Prime

Nouveau
GLM-5.3-Prime is the high-speed variant of Z.ai's GLM-5.3, inheriting its full capabilities while delivering 1.5–2× the output throughput through inference acceleration. It supports text input and output with a 1M-token...
z-ai/glm-5.3-primeidentifiant OpenRouter

Tarifs · par million de tokens, HT

Entrée
2,8 $2,49 €
Sortie
8,8 $7,84 €
Cache, lecture
0,56 $0,499 €
Usage type
36,8 $ pour 1 000 requêtes (10k tokens en entrée, 1k en sortie)
Relevé sur
OpenRouter (prix de la route OpenRouter)

Limites et quotas

Contexte
1M1 000 000 tokens
Sortie max
128k
Quotas indicatifs
non publiés dans les sources ouvertes
Connaissances
—

Capacités

Entrée → sortie
texte → texte
Vision · OCR
non
Raisonnement
oui
Appel d'outils
oui
Sorties JSON
oui
Poids ouverts
non

Éditeur et provenance

Éditeur
Z.ai (Zhipu)
Pays
ChineCN · Chine
Siège
Pékin
Gammes
GLM
Sortie
23 sept. 2026
Suivi depuis
29 sept. 2026
Liens officiels
TarifsChangelog

Où l'utiliser

Celui qui fabrique un modèle n'est pas forcément celui qui l'exécute : le même modèle peut s'appeler chez l'éditeur, dans un grand cloud ou chez un hébergeur européen, avec des contrats et des lieux de traitement différents.

API de l'éditeur

Grands clouds

Aucun grand cloud recensé.

Hébergeurs européens

Aucun hébergeur européen recensé.

Prix par million de tokens (entrée / sortie) publiés par chaque hébergeur · source : models.dev

Sources : OpenRouter · relevées le 5 oct. 2026, 12:00 · 1 $ = 0,891 € (BCE, 2 oct. 2026)

Radar

Ce qui a changé.

  • Sortie

    Z.ai (Zhipu)GLM 5.3 Prime

    2,8 $ / 8,8 $ par M tokens · contexte 1M · texte → texte

Z.ai (Zhipu)

Du même éditeur.

ModèleSortieEntrée / sortie, par M tokens
GLM-5.3-FlashX18 sept. 20260,37 $ / 1,25 $
GLM-5.3-Flash26 août 20260,15 $ / 0,5 $
GLM-5.314 août 20261,4 $ / 4,4 $
GLM-5.213 juin 20261,4 $ / 4,4 $
GLM-5.17 avr. 20261,4 $ / 4,4 $
GLM-5V-Turbo1 avr. 20261,2 $ / 4 $
GLM-5-Turbo16 mars 20261,2 $ / 4 $
GLM-512 févr. 20261 $ / 3,2 $