Intelligence artificielle

Le modèle GLM-5.3 arrive sur l’API au prix de 1,40 dollar par million de jetons d’entrée

z.ai a rendu son modèle GLM-5.3 disponible via une interface API au même prix que le modèle GLM-5.2, avec un coût inférieur pour les entrées mises en cache. Les développeurs disposent ainsi d’une nouvelle option pour tester des tâches de programmation et des agents logiciels, tandis que la date d’ouverture des poids du modèle et les conditions de licence restent indéterminées.

2026-08-18
5 min de lecture
20 vues
فريق تحرير certi.news
Le modèle GLM-5.3 arrive sur l’API au prix de 1,40 dollar par million de jetons d’entrée

Le modèle GLM-5.3 de l’entreprise chinoise z.ai est désormais disponible via une interface de programmation d’applications (API), ce qui permet aux développeurs de l’intégrer à des applications et à des agents logiciels au lieu de l’utiliser directement uniquement dans le cadre des forfaits de l’entreprise. Ce lancement intervient au même prix que celui du GLM-5.2, malgré l’annonce par z.ai d’améliorations importantes en matière de programmation et de capacités d’exécution de tâches à long terme.

Tarifs et modalités d’accès

z.ai facture 1,40 dollar par million de jetons d’entrée et 4,40 dollars par million de jetons de sortie. Les jetons d’entrée mis en cache coûtent quant à eux 0,26 dollar par million de jetons, tandis que l’entreprise propose gratuitement le stockage des entrées mises en cache pendant une période limitée.

Le maintien du prix par rapport au GLM-5.2 signifie que la différence entre les deux générations n’apparaît pas dans le prix annoncé par jeton. Cela ne signifie toutefois pas nécessairement que le coût total d’une tâche sera identique, car la facture dépend du volume des entrées et des sorties, de l’utilisation du cache et du nombre de jetons générés par le modèle.

Les utilisateurs qui avaient auparavant souscrit au GLM Coding Plan n’ont actuellement accès qu’au protocole compatible avec OpenAI Chat Completions. z.ai a également déclaré son intention de rendre les poids du modèle disponibles ouvertement, mais l’entreprise n’a pas fixé de date précise et n’a pas indiqué la licence qui régira cette utilisation.

Comment le prix se compare-t-il à celui des autres modèles ?

Selon la comparaison simplifiée de VentureBeat, qui suppose l’utilisation d’un million de jetons d’entrée et d’un million de jetons de sortie, le coût du GLM-5.3 atteint 5,80 dollars. La même comparaison donne 8 dollars pour Grok 4.6 au niveau de contexte inférieur, 18 dollars pour Kimi K3, 30 dollars pour Claude Opus 5 et 35 dollars pour GPT-5.6 Sol.

Ces chiffres illustrent davantage la catégorie de prix qu’ils ne fournissent une estimation d’une facture d’exploitation réelle. Le GLM-5.3 n’est pas le moins cher parmi les modèles performants : Google propose un prix promotionnel pour Gemini 3.7 Flash de 0,75 dollar par entrée et 3,75 dollars par sortie jusqu’au 31 décembre 2026, tandis que GPT-5.6 Luna d’OpenAI coûte environ 0,20 dollar par entrée et 1,20 dollar par sortie. Le prix du modèle de z.ai reste néanmoins inférieur à celui d’un certain nombre d’interfaces de modèles avancés auxquels il est comparé.

Qu’est-ce que cela signifie pour les développeurs ?

L’avantage pratique immédiat est qu’une équipe de développement peut tester un nouveau modèle pour la programmation ou l’exécution d’agents logiciels sans augmentation du prix annoncé des jetons par rapport au GLM-5.2. Cela peut faciliter la comparaison des performances et des coûts au sein d’applications qui reposent sur des appels API répétés.

Mais le prix fixe ne suffit pas pour juger de l’efficacité. Artificial Analysis a attribué au modèle GLM-5.3 un score de 60 dans l’Intelligence Index, soit le même score que celui obtenu par Kimi K3, les deux étant, selon la comparaison citée, les deux modèles à poids ouverts les mieux classés. Le GLM-5.3 a également dépassé de sept points le score du GLM-5.2.

En revanche, Artificial Analysis a estimé le coût de chaque tâche de l’indice à environ 0,68 dollar pour le GLM-5.3, contre environ 0,44 dollar pour le GLM-5.2, malgré l’identité du prix des jetons sur l’API. Cela s’explique par le fait que le GLM-5.3 est plus verbeux que son prédécesseur, ce qui peut entraîner la consommation d’un plus grand nombre de jetons pour accomplir la même tâche.

La première apparition du modèle avait, selon le rapport, été associée à des capacités cybernétiques avancées qui l’auraient aidé à découvrir une vulnérabilité jusque-là inconnue dans Cursor. Le texte ne fournit pas de détails supplémentaires permettant de vérifier ce résultat ; ce point reste donc une affirmation rapportée et ne constitue pas une base suffisante pour une évaluation de sécurité indépendante du modèle.

Source de l’actualité
VentureBeat Startups & Funding
Ouvrir la source originale ↗
ف
Auteur

فريق تحرير certi.news

Dans la même catégorie

À lire également

Voir toutes les actualités