luca100

Z.ai (Zhipu) · Chine

GLM-4.5

Poids ouverts
GLM-4.5 is our latest flagship foundation model, purpose-built for agent-based applications. It leverages a Mixture-of-Experts (MoE) architecture and supports a context length of up to 128k tokens. GLM-4.5 delivers significantly...
glm-4.5identifiant de l'API Z.ai (Zhipu)

Tarifs · par million de tokens, HT

Entrée
0,6 $0,535 €
Sortie
2,2 $1,96 €
Cache, lecture
0,11 $0,098 €
Usage type
8,2 $ pour 1 000 requêtes (10k tokens en entrée, 1k en sortie)
Relevé sur
models.dev (API officielle)

Limites et quotas

Contexte
128k131 072 tokens
Sortie max
96k
Quotas indicatifs
non publiés dans les sources ouvertes
Connaissances
avr. 2025
Fin de service
31 déc. 2026

Capacités

Entrée → sortie
texte → texte
Vision · OCR
non
Raisonnement
oui
Appel d'outils
oui
Sorties JSON
non

Éditeur et provenance

Éditeur
Z.ai (Zhipu)
Pays
ChineCN · Chine
Siège
Pékin
Gammes
GLM
Sortie
28 juil. 2025
Suivi depuis
29 sept. 2026
Liens officiels
TarifsChangelog

Où l'utiliser

Celui qui fabrique un modèle n'est pas forcément celui qui l'exécute : le même modèle peut s'appeler chez l'éditeur, dans un grand cloud ou chez un hébergeur européen, avec des contrats et des lieux de traitement différents.

API de l'éditeur

Grands clouds

Aucun grand cloud recensé.

Hébergeurs européens

Aucun hébergeur européen recensé.

+ 13 autres hébergeurs et passerelles (OpenRouter, Together, DeepInfra…). Prix par million de tokens (entrée / sortie) publiés par chaque hébergeur · source : models.dev

Sources : models.dev · OpenRouter · LiteLLM · relevées le 5 oct. 2026, 12:00 · 1 $ = 0,891 € (BCE, 2 oct. 2026)

Radar

Ce qui a changé.

Z.ai (Zhipu)

Du même éditeur.

ModèleSortieEntrée / sortie, par M tokens
GLM 5.3 Prime23 sept. 20262,8 $ / 8,8 $
GLM-5.3-FlashX18 sept. 20260,37 $ / 1,25 $
GLM-5.3-Flash26 août 20260,15 $ / 0,5 $
GLM-5.314 août 20261,4 $ / 4,4 $
GLM-5.213 juin 20261,4 $ / 4,4 $
GLM-5.17 avr. 20261,4 $ / 4,4 $
GLM-5V-Turbo1 avr. 20261,2 $ / 4 $
GLM-5-Turbo16 mars 20261,2 $ / 4 $