GLM-5.3 et GLM-5.3-Flash : benchmarks, capacités cyber, Ox Alpha, open weights et comparaison avec Kimi K3, Hy4, Claude et GPT-5.6 Sol Skip to content

GLM-5.3 et GLM-5.3-Flash : benchmarks, capacités cyber, Ox Alpha, open weights et comparaison avec Kimi K3, Hy4, Claude et GPT-5.6 Sol

Analyse vérifiée de GLM-5.3 et GLM-5.3-Flash : architecture, contexte 1M, 753B/40B et 320B/18B, multimodalité, Ox Alpha, benchmarks coding et cyber, licences, prix API, self-hosting et comparaison avec Kimi K3, Hy4, Claude et GPT-5.6 Sol.

Publié Rédigé par Temps de lecture 23 min de lecture

Analyse vérifiée de GLM-5.3 et GLM-5.3-Flash : architecture, contexte 1M, 753B/40B et 320B/18B, multimodalité, Ox Alpha, benchmarks coding et cyber, licences, prix API, self-hosting et comparaison avec Kimi K3, Hy4, Claude et GPT-5.6 Sol.

Sur cette page
  1. 1TL;DR
  2. 2Que s’est-il passé en août ?
  3. 3GLM-5.3 n’est pas simplement un Flash plus grand
  4. 4Combien de paramètres pour GLM-5.3 ?
  5. 5Flash : 320B total, 18B actifs
  6. 6Contexte 1M et output 128K
  7. 7GLM-5.3 est text-only, Flash multimodal
  8. 8Sparse + linear attention
  9. 9IndexPool
  10. 10Manifold-Constrained Hyper-Connections
  11. 11Pre-training multimodal de 30T tokens
  12. 12Ox Alpha était Flash
  13. 13Pourquoi le test stealth est intéressant
  14. 14Le saut GLM-5.3 vient du post-training
  15. 15Que signifie « +50% coding » ?
  16. 16Benchmarks publics coding/agents
  17. 17Terminal-Bench 3.0 : énorme progression
  18. 18DeepSWE : 66.9
  19. 19Terminal-Bench 2.1 : quasi égalité
  20. 20Agents' Last Exam
  21. 21CyberGym : 84.5%
  22. 22ExploitBench : limite plus nette
  23. 23ExploitGym
  24. 242 436 vulnérabilités signalées
  25. 25Les capacités cyber exigent une gouvernance dédiée
  26. 26Benchmarks Flash
  27. 27Flash vs Opus 4.8 sur Z.ai Code Bench
  28. 28Artificial Analysis : 60 vs 57
  29. 29Prix API
  30. 30« One-tenth the price » est raisonnable
  31. 31GLM-5.3 vs Kimi K3
  32. 32GLM-5.3 vs Hy4
  33. 33GLM-5.3 vs GPT-5.6 Sol
  34. 34Et Claude Opus 5 ?
  35. 35Open weights et licences
  36. 36Self-hosting
  37. 37Puces AI chinoises et gain serving 3×
  38. 38Quel modèle choisir ?
  39. 39Checklist de POC
  40. 40Verdict POLPROG

La fin du mois d’août 2026 a apporté deux modèles très différents de la même génération Z.ai.

GLM-5.3 est le grand modèle de reasoning textuel destiné aux tâches d’ingénierie long-horizon, aux coding agents et à des capacités de cybersécurité en forte progression. Z.ai l’a annoncé le 14 août, puis a publié les poids sur Hugging Face le 28 août après la période de safety evaluation et de hardening annoncée au lancement.[1][17]

GLM-5.3-Flash est un modèle beaucoup moins cher, nativement multimodal et basé sur un nouveau pre-training. Il possède 320B paramètres au total, 18B actifs par token, un contexte 1M, accepte text/image/video/file et publie ses poids sous licence MIT.[6][8][11]

Avant son lancement officiel, Flash a été testé anonymement comme :

Ox Alpha

sur OpenCode et OpenRouter. Z.ai affirme qu’il est rapidement devenu le modèle le plus utilisé de la semaine et que ce trafic a été servi sur des accélérateurs AI chinois. Cette popularité reste une affirmation du fournisseur.[6][7][19]

Les deux modèles ne sont pas simplement une version grande et une version petite du même réseau.

GLM-5.3 :

env. 753B total selon les métadonnées HF/AA actuelles
env. 40B actifs
text-only
contexte 1M
output max 128K
reasoning toujours activé
licence GLM-5.3 personnalisée

GLM-5.3-Flash :

320B total
18B actifs
multimodal natif
contexte 1M
output max 128K
sparse + linear attention
MIT

[2][6][10][11]

Les benchmarks de lancement sont principalement Z.ai-reported. Les évaluations agentiques dépendent du harness, du tooling, du budget de tokens, du contexte et de la configuration d’inférence. Il faut donc distinguer faits techniques, chiffres fournisseur et mesures indépendantes.

État des informations : 31 août 2026.

TL;DR

QuestionRéponse vérifiée
GLM-5.3 annoncé14 août 2026
Poids GLM-5.3 publicsdepuis le 28 août
GLM-5.3-Flashfin août; Artificial Analysis indique le 26 août
Taille GLM-5.3753B dans HF/AA, env. 40B actifs
Flash320B total, 18B actifs
GLM-5.3 inputtexte
Flash inputtexte, image, vidéo, fichier selon Z.ai
Contexte1M pour les deux
Output max128K pour les deux
Reasoningtoujours activé; low, high, max; défaut max
Licence GLM-5.3GLM-5.3 License personnalisée
Licence FlashMIT
API GLM-5.3$1.40 input / $0.26 cache / $4.40 output par 1M
Flash prix catalogue$0.15 / $0.03 / $0.50
Promo Flash au 9/09/2026$0.075 / $0.015 / $0.25
Terminal-Bench 2.188.2, Z.ai-reported
Terminal-Bench 3.028.3, Z.ai-reported
DeepSWE v1.166.9, Z.ai-reported
CyberGym84.5%, Z.ai-reported
ExploitBench54.4%, Z.ai-reported
Ox Alphaidentité pre-release de Flash
Artificial AnalysisGLM-5.3 60, Flash 57
Hy4 vs GLM-5.3blind test Tencent : 2.99 vs 2.92
Caveat principalles benchmarks agentiques dépendent fortement du setup

Que s’est-il passé en août ?

Z.ai a annoncé GLM-5.3 le 14 août 2026.[1]

Le point inhabituel : le base model n’a pas changé par rapport à GLM-5.2. Z.ai indique que tous les gains viennent du post-training.[1][15]

L’API était disponible immédiatement, tandis que les poids devaient arriver après environ deux semaines d’évaluation de sécurité supplémentaire. Hugging Face affichait le 28 août comme date de publication prévue et les poids sont maintenant disponibles.[17][5]

GLM-5.3-Flash suit une autre voie : nouvelle base, nouvelle architecture et multimodalité native.[6][8]

GLM-5.3 n’est pas simplement un Flash plus grand

GLM-5.3

Priorités :

qualité maximale de la famille GLM
coding
long-horizon agents
terminal
cyber reasoning

GLM-5.3-Flash

Priorités :

coût
multimodalité
efficacité d’inférence
visual coding
workflows office
long context

Flash n’est pas une simple distillation de GLM-5.3. Z.ai le présente comme un nouveau base model.[6][8]

Combien de paramètres pour GLM-5.3 ?

L’architecture GLM-5 originale était présentée comme :

744B total
40B actifs

[16]

Les métadonnées Hugging Face et Artificial Analysis actuelles donnent pour GLM-5.3 :

753B total
40B actifs

[5][10]

GLM-5.3 partage la base de GLM-5.2.[1][15]

Nous traitons donc l’écart 744B/753B comme une différence de comptage/implémentation et utilisons 753B/40B pour les comparaisons de déploiement actuelles.

Flash : 320B total, 18B actifs

Z.ai indique :

320B total
18B actifs
45 couches

[6][8]

Pour comparaison, GLM-4.5 est présenté avec 355B total, 32B actifs et 92 couches.[6]

Flash réduit fortement le compute actif.

Contexte 1M et output 128K

Les docs Z.ai actuelles donnent pour les deux modèles :

Context Length: 1M
Maximum Output: 128K

[2][6]

C’est utile pour les gros repositories, les sessions agentiques longues, l’analyse multi-fichiers et les workflows documentaires.

Mais 1M de contexte ne signifie pas 1M de mémoire parfaite. Retrieval et instruction retention doivent être testés.

GLM-5.3 est text-only, Flash multimodal

GLM-5.3 :

Input: Text
Output: Text

[2]

Flash :

Input:
Text
Image
Video
File

Output:
Text

[6]

Flash est donc beaucoup plus adapté aux screenshots, interfaces, documents, PDF, présentations, images et visual coding.

Artificial Analysis standardise actuellement le profil Flash sur texte+image dans ses tests, sans contredire les modalités plus larges documentées par Z.ai.[11]

Sparse + linear attention

Flash combine :

Sparse Attention
+
Linear Attention

[6][8]

Linear attention vise les dépendances locales via state modeling, tandis que sparse attention récupère les informations pertinentes dans le contexte global.

Objectif : réduire le coût d’inférence en long context.

IndexPool

Pour le contexte 1M, Z.ai ajoute :

IndexPool

[6]

Quatre key vectors de l’indexer sont compressés en un via weighted pooling.

Z.ai annonce par rapport à GLM-5.3 :

3.01× moins d'attention compute
4.44× moins de KV cache

[6]

Ce sont des chiffres fournisseur, pas une réplication indépendante.

Manifold-Constrained Hyper-Connections

Flash utilise aussi :

mHC
Manifold-Constrained Hyper-Connections

[6][8]

L’objectif est d’améliorer le flux d’information et l’efficacité du scaling.

Le résultat recherché est de conserver une grande part de la qualité flagship avec seulement 18B paramètres actifs.

Pre-training multimodal de 30T tokens

Z.ai indique :

30T-token multimodal corpus

[6][8]

C’est une différence majeure : GLM-5.3 garde le base model GLM-5.2 et progresse via post-training, tandis que Flash reçoit un nouveau pre-training multimodal.

Ox Alpha était Flash

Avant le nom officiel :

ox-alpha

était disponible sur OpenCode et OpenRouter.[6][19]

Z.ai confirme que cette identité correspondait à GLM-5.3-Flash.

L’affirmation « modèle le plus populaire de la semaine » reste un chiffre/claim Z.ai.[7]

Pourquoi le test stealth est intéressant

L’anonymat réduit une partie du biais de marque.

Mais ce n’était pas un test scientifique contrôlé. Usage et popularité dépendent aussi du prix, du routing, de la disponibilité, de l’interface et des promotions.

Le signal fiable est donc une vraie adoption utilisateur, pas une preuve de supériorité universelle.

Le saut GLM-5.3 vient du post-training

Z.ai affirme avoir conservé la même base que GLM-5.2.[1][15]

La société a surtout augmenté :

  • le nombre d’environnements,
  • la diversité des tâches,
  • le compute post-training,
  • les tâches long-horizon,
  • les verifiers,
  • le reinforcement learning,
  • la génération automatique d’environnements.

Le framework open-source slime relie training, rollout et data generation.[1]

Que signifie « +50% coding » ?

Z.ai communique :

+50% vs GLM-5.2

[1][2]

Ce chiffre vient de son benchmark privé Z.ai Code Bench.

En Max effort :

GLM-5.3: 34.5%
~75K output tokens/task

GLM-5.2: 23.4%
~96K output tokens/task

[1]

C’est intéressant, mais ce n’est pas « 50% meilleur sur tous les problèmes de programmation ».

Benchmarks publics coding/agents

Table Z.ai sélectionnée :[3]

BenchmarkGLM-5.3GLM-5.2Kimi K3Opus 4.8Fable 5GPT-5.6 Sol
Terminal-Bench 2.188.281.088.385.088.088.8
Terminal-Bench 3.028.34.617.421.133.734.6
DeepSWE66.946.267.558.069.772.7
Toolathlon73.059.976.576.274.774.9
AutomationBench48.226.246.741.046.245.8
Agents' Last Exam28.523.827.625.723.828.6
HLE + Tools62.554.759.857.963.964.5
GDPval-AA v2176915081682158817431730

Tous ces résultats sont Z.ai-reported.

Terminal-Bench 3.0 : énorme progression

GLM-5.2: 4.6
GLM-5.3: 28.3

[1][3]

Le score numérique est plus de six fois supérieur, mais cela ne signifie pas « 6× plus intelligent ».

Le harness Z.ai utilise Claude Code 2.1.207, max effort, grand contexte, jusqu’à 600 tours agent et un timeout long.[3]

DeepSWE : 66.9

GLM-5.2: 46.2
GLM-5.3: 66.9
Kimi K3: 67.5
GPT-5.6 Sol: 72.7

[3]

GLM progresse fortement, mais Kimi et GPT restent devant dans cette table.

Terminal-Bench 2.1 : quasi égalité

GLM-5.3: 88.2
Kimi K3: 88.3
GPT-5.6 Sol: 88.8
Fable 5: 88.0

[3]

Les écarts sont trop faibles pour justifier des superlatifs.

Agents' Last Exam

GLM-5.3: 28.5
GPT-5.6 Sol: 28.6
Kimi K3: 27.6

[3]

Encore une fois, la tête est très serrée.

CyberGym : 84.5%

Z.ai rapporte :

GLM-5.3: 84.5%
GPT-5.6 Sol: 83.6%
Fable 5: 83.8%
Kimi K3: 80.0%
GLM-5.2: 77.2%

[1][3]

CyberGym part de source code white-box et vérifie la découverte/validation de vulnérabilités.

Ce benchmark ne mesure pas directement la capacité à compromettre n’importe quel système réel.

ExploitBench : limite plus nette

GLM-5.3: 54.4%
GLM-5.2: 24.4%
Kimi K3: 32.2%
Opus 4.8: 40.0%
Fable 5: 78.0%
GPT-5.6 Sol: 76.5%

[1][3]

Le gain est massif, mais les meilleurs closed models restent nettement devant.

ExploitGym

Tâches terminées 2h/6h selon Z.ai :

GLM-5.3: 105 / 130
Kimi K3: 36 / 70
Fable 5: 181 / 247
GPT-5.6 Sol: 216 / 293

[3]

Le temps est normalisé selon le throughput de chaque modèle. La méthodologie doit donc être prise en compte.

2 436 vulnérabilités signalées

Z.ai déclare, après review et déduplication :

2,436 findings
269 projets
1,097 critical + high

[1][2]

Le ledger indique :

53 publics
2,383 sous embargo
107 critical
990 high
1,286 medium
53 low

[1]

Il s’agit de données opérationnelles Z.ai, pas d’une base indépendante de CVE.

Les capacités cyber exigent une gouvernance dédiée

Usages défensifs possibles :

  • secure code review,
  • vulnerability triage,
  • reproduction en sandbox,
  • augmentation SAST,
  • analyse de patch,
  • fuzzing,
  • threat modeling.

En parallèle : network isolation, logs, approval gates, séparation des secrets et credentials minimaux.

Benchmarks Flash

Z.ai rapporte :[7][8]

BenchmarkFlashGLM-5.2
Terminal-Bench 2.184.381.0
DeepSWE63.446.2
NL2Repo56.348.9
Toolathlon78.459.9
AutomationBench48.826.2
Agents' Last Exam26.320.4
HLE + Tools55.354.7
GDPval-AA v217731504

Le point majeur est le rapport qualité/prix, pas une égalité automatique avec GLM-5.3.

Flash vs Opus 4.8 sur Z.ai Code Bench

Z.ai indique :

Flash: 29.0
Opus 4.8: 29.5

[6]

Comme le benchmark est privé, on ne peut pas en conclure que Flash « égale Claude » partout.

Artificial Analysis : 60 vs 57

Artificial Analysis Intelligence Index v4.1.1 :

GLM-5.3 max: 60
Flash: 57

[10][11][12]

Mesures API first-party actuelles :

GLM-5.3: ~66.5 tokens/s, ~1.6 s TTFT
Flash: ~45–49 tokens/s, ~1.5 s TTFT

[10][11][20]

Le nom « Flash » ne signifie donc pas nécessairement le meilleur throughput tokens/s. Son avantage principal est le coût, le compute actif et la multimodalité.

Prix API

Z.ai liste :[9]

GLM-5.3

Input $1.40
Cached $0.26
Output $4.40

Flash catalogue

Input $0.15
Cached $0.03
Output $0.50

Flash promo jusqu’au 9 septembre

Input $0.075
Cached $0.015
Output $0.25

par 1M tokens.

OpenRouter propose également les deux modèles, mais les tarifs provider peuvent différer.[18][19]

« One-tenth the price » est raisonnable

Au tarif catalogue, Flash est environ :

9.3× moins cher en input
8.8× moins cher en output

[9]

Dire « environ un dixième » est donc une approximation marketing raisonnable. Le coût par tâche dépend cependant du reasoning, du nombre de tokens et des tool calls.

GLM-5.3 vs Kimi K3

Table Z.ai :[3]

TB 2.1: 88.2 vs 88.3
DeepSWE: 66.9 vs 67.5
TB 3.0: 28.3 vs 17.4
AutomationBench: 48.2 vs 46.7
ExploitBench: 54.4 vs 32.2

Kimi gagne légèrement certains benchmarks coding; GLM est nettement devant dans TB3 et les evals security publiées par Z.ai.

GLM-5.3 vs Hy4

Tencent a réalisé un blind test interne avec 163 experts et 203 tâches.[13][14]

Hy4: 2.99
Kimi K3: 2.94
GLM-5.3: 2.92

Hy4 contre GLM :

46.8% wins
12.8% ties
40.4% losses

[14]

Ce résultat appartient au workload Tencent et ne doit pas être fusionné avec les tables Z.ai.

GLM-5.3 vs GPT-5.6 Sol

Dans Z.ai :[3]

Terminal-Bench 3.0: 28.3 vs 34.6
DeepSWE: 66.9 vs 72.7
ExploitBench: 54.4 vs 76.5
ExploitGym 6h: 130 vs 293
HLE + Tools: 62.5 vs 64.5

GLM est légèrement devant sur CyberGym et AutomationBench.

Conclusion : comparaison mixte, pas victoire générale.

Et Claude Opus 5 ?

Le tableau de lancement Z.ai compare surtout Opus 4.8 et Fable 5, pas Opus 5.[3]

Il serait donc faux d’écrire :

GLM-5.3 > Claude Opus 5

sur cette base.

Open weights et licences

Flash

MIT

[8][11]

GLM-5.3

GLM-5.3 License personnalisée

[4]

La licence permet largement usage, modification, distribution, fine-tuning et vente.

Mais les opérateurs de Model as a Service dépassant 10 milliards USD de revenu agrégé sur 12 mois consécutifs doivent passer une security review Z.ai avant usage commercial du modèle ou de ses dérivés.[4]

La formulation précise est donc « open weights sous licence personnalisée », pas « MIT ».

Self-hosting

Les chemins officiels couvrent :

vLLM
SGLang
Transformers
Docker Model Runner

et d’autres frameworks.[3][8]

Le repository GLM-5.3 principal représente environ :

756 GB
141 shards safetensors

[5]

Flash est plus léger en compute actif, mais reste un gros modèle.

Puces AI chinoises et gain serving 3×

Z.ai affirme que le trafic Flash/Ox Alpha a été servi sur un grand cluster d’accélérateurs AI chinois.[6][7]

Optimisations citées :

Tensor Parallelism
ReplaySSM
W8A8
cache INT8/FP8/BF16
Layer Split
Encode–Prefill–Decode disaggregation

Z.ai annonce 3× le serving end-to-end par rapport à son baseline initial sur le même hardware.[6][7]

C’est un vendor claim à valider indépendamment.

Quel modèle choisir ?

GLM-5.3

Pour qualité coding maximale de la famille, terminal agents, reasoning textuel et security analysis.

Flash

Pour coût, vision, screenshots, documents, video/file input, contexte 1M et licence MIT.

Kimi, Hy4, GPT ou Claude

Si votre propre POC donne un meilleur :

cost per successful task

Checklist de POC

Qualité

  • Tester de vraies tâches internes.
  • Utiliser le même harness.
  • Mesurer test pass rate.
  • Mesurer task completion.
  • Mesurer les régressions.
  • Mesurer les changements hors scope.
  • Tester les longues sessions.
  • Tester recovery.
  • Valider tool calling.
  • Valider structured output.

Reasoning

  • Comparer low, high, max.
  • Le reasoning ne peut pas être désactivé.
  • Mesurer reasoning tokens.
  • Mesurer output total.
  • Mesurer latence end-to-end.
  • Ne pas utiliser max par défaut pour chaque tâche simple.

Long context

  • Tester 32K.
  • Tester 128K.
  • Tester 256K.
  • Tester 1M.
  • Mesurer retrieval accuracy.
  • Mesurer instruction loss.
  • Tester gros repositories.
  • Tester cross-file dependencies.
  • Mesurer KV cache et concurrency.
  • Ne pas assimiler 1M à une mémoire parfaite.

Multimodalité Flash

  • Tester screenshots.
  • Tester documents.
  • Tester charts.
  • Tester workflows type OCR.
  • Tester GUI verification.
  • Tester vidéo avec données réelles.

Security

  • Sandboxer les workflows cyber.
  • Limiter le réseau.
  • Logger les tool calls.
  • Ajouter approval gates.
  • Séparer les secrets production.
  • Limiter les credentials.
  • Valider les patches avant merge.
  • Ne pas traiter le modèle comme autorité autonome.

Licence et opérations

  • Lire GLM-5.3 License.
  • Vérifier la clause MaaS >$10B.
  • Vérifier les obligations MIT de Flash.
  • Vérifier la politique de données du provider.
  • Vérifier processing region.
  • Vérifier retention.
  • Mesurer cache hit rate.
  • Mesurer cost per successful task.
  • Définir fallback model.
  • Surveiller le prix Flash après promo.

Verdict POLPROG

GLM-5.3 est l’une des sorties coding majeures d’août 2026, non parce qu’il aurait battu tous les autres modèles, mais parce que la même base que GLM-5.2 a fortement progressé grâce au post-training.[1][15]

Terminal-Bench 3.0: 4.6 → 28.3
DeepSWE: 46.2 → 66.9
ExploitBench: 24.4 → 54.4

[1][3]

Flash suit une autre stratégie :

320B total
18B actifs
multimodal natif
1M context
MIT
API très peu chère

et obtient 57 à l’Artificial Analysis Intelligence Index contre 60 pour GLM-5.3 max.[10][11][12]

Pour de nombreux produits, Flash peut donc être plus intéressant économiquement que le flagship.

La décision raisonnable n’est pas « quel modèle gagne Internet ? », mais :

Quel modèle fournit le meilleur cost per successful task dans notre propre environnement avec la qualité, la sécurité et la latence nécessaires ?

GLM-5.3 GLM-5.3-Flash Z.ai Ox Alpha Open Weights Coding AI Cybersecurity AI Kimi K3 Hy4 GPT-5.6 Sol

Questions fréquentes

Date GLM-5.3 ?

Annonce le 14 août; poids publics depuis le 28 août 2026.

GLM-5.3 est-il open source ?

Plus précisément : open weights sous GLM-5.3 License personnalisée.

Flash ?

Poids publics sous MIT.

Paramètres GLM-5.3 ?

Environ 753B total / 40B actifs dans les métadonnées actuelles; architecture GLM-5 historiquement annoncée 744B/40B.

Flash ?

320B total / 18B actifs.

Contexte ?

1M pour les deux.

Output max ?

128K.

Vision ?

GLM-5.3 text-only; Flash multimodal.

Reasoning désactivable ?

Non actuellement.

Effort ?

low, high, max.

Ox Alpha ?

Nom anonyme pre-release de Flash.

Meilleur que Kimi K3 ?

Pas dans tous les benchmarks.

Meilleur que Hy4 ?

Tencent donne 2.99 à Hy4 et 2.92 à GLM dans son blind test interne.

Meilleur que GPT-5.6 Sol ?

Pas globalement; GPT reste devant sur plusieurs evals difficiles.

Meilleur que Claude Opus 5 ?

Non démontré par le tableau de lancement Z.ai.

84.5% CyberGym = meilleur modèle security ?

Non. Les modèles closed restent plus hauts sur des evals exploitation plus profondes.

Prix GLM-5.3 ?

$1.40 input, $0.26 cache, $4.40 output par 1M.

Prix Flash ?

Catalogue $0.15 / $0.03 / $0.50; promo jusqu’au 9 septembre $0.075 / $0.015 / $0.25.

Self-hosting ?

Oui, avec de fortes exigences hardware.

Choix production ?

POC contrôlé avec qualité, latence, tokens, tool calls et cost per successful task.

Sources et notes

  1. Z.ai, GLM-5.3: Frontier Coding with Emergent Cyber Capabilities, 14 août 2026, consulté le 31 août 2026.123456789101112131415
  2. Z.ai Developer Docs, GLM-5.3 — Overview, consulté le 31 août 2026.12345
  3. Z.ai / Hugging Face, GLM-5.3 — model card officiel, consulté le 31 août 2026.1234567891011121314
  4. Z.ai / Hugging Face, GLM-5.3 License, consulté le 31 août 2026.12
  5. Hugging Face, zai-org/GLM-5.3 — files and versions, consulté le 31 août 2026.123
  6. Z.ai Developer Docs, GLM-5.3-Flash — Overview, consulté le 31 août 2026.123456789101112131415161718
  7. Z.ai, GLM-5.3-Flash: Frontier Intelligence, Flash Cost, août 2026, consulté le 31 août 2026.12345
  8. Z.ai / Hugging Face, GLM-5.3-Flash — model card officiel, consulté le 31 août 2026.12345678910
  9. Z.ai Developer Docs, Pricing, consulté le 31 août 2026.12
  10. Artificial Analysis, GLM-5.3 (max), état 31 août 2026.12345
  11. Artificial Analysis, GLM-5.3-Flash, état 31 août 2026.1234567
  12. Artificial Analysis, GLM-5.3-Flash vs GLM-5.3 (max), état 31 août 2026.12
  13. Tencent, Tencent Releases and Open-Sources Tencent Hy4 preview, 28 août 2026.
  14. Tencent / Hugging Face, Hy4 preview — model card officiel, consulté le 31 août 2026.12
  15. Z.ai, GLM-5.2: Built for Long-Horizon Tasks, 16 juin 2026.1234
  16. GLM-5 Team, GLM-5: from Vibe Coding to Agentic Engineering, arXiv:2602.15763, 2026.
  17. Hugging Face, zai-org/GLM-5.3, release marker vérifié le 31 août 2026.12
  18. OpenRouter, Z.ai: GLM 5.3, état 31 août 2026.
  19. OpenRouter, Z.ai: GLM 5.3 Flash, état 31 août 2026.123
  20. Artificial Analysis, GLM-5.3-Flash API Provider Benchmarking, état 31 août 2026.

Cela vous a-t-il été utile ?

Recevez les nouveaux articles par e-mail

Un court e-mail par nouvel article d'apprentissage. Pas de spam, désinscription en un clic.

Nous utilisons uniquement votre e-mail pour envoyer de nouveaux articles. Aucun partage avec des tiers.

Retour à l'apprentissage