GLM-5.3, le modèle frontière chinois, ouvre son API à 1,4 / 4,4 dollars par million de tokens
La start-up chinoise z.ai rend son modèle GLM-5.3 accessible par API, une semaine après sa présentation. Le tarif annoncé — 1,4 dollar par million de tokens en entrée, 4,4 dollars en sortie — le place nettement sous les grilles des modèles frontière américains équivalents, ce qui en fait un candidat sérieux pour les usages agentiques à fort volume, où le coût par appel devient le facteur limitant.
Ce positionnement tarifaire compte davantage que les scores de benchmark pris isolément. Un modèle qui tient le rythme des meilleurs à un tiers du prix change le calcul économique des applications qui enchaînent des dizaines d'appels par tâche : assistants de code, pipelines de traitement documentaire, agents autonomes. C'est précisément le segment sur lequel les laboratoires américains ont bâti leurs revenus API.
z.ai indique vouloir publier les poids du modèle, sans avoir communiqué de date ni de licence précise. Tant que ces deux points restent en suspens, l'étiquette « open source » mérite d'être prise avec prudence : la disponibilité en API et la publication des poids sous licence permissive sont deux choses différentes. Les développeurs déjà abonnés au forfait GLM Coding Plan sont pour l'instant restreints au protocole compatible avec l'API Chat Completions d'OpenAI.
Un point demande vérification indépendante : le modèle aurait, selon les comptes rendus de son lancement, identifié une vulnérabilité jusque-là inconnue dans Cursor. Si elle se confirme, cette capacité offensive appliquée à du code de production alimentera le débat sur ce qu'il est raisonnable de publier en poids ouverts.