Le Courrier de la Soie est un média indépendant dédié à l'actualité de la Chine qui publie chaque jour des synthèses rédigées en français.

Économie

Les actions de Z.AI flambent après l’attribution d’Ox Alpha, rebaptisé GLM-5.3-Flash

Z.AI a revendiqué Ox Alpha et rebaptisé le modèle GLM-5.3-Flash, provoquant une hausse de 12,6 % de son titre à Hong Kong.

2 min de lecture
Les actions de Z.AI flambent après l’attribution d’Ox Alpha, rebaptisé GLM-5.3-Flash
Photo : Brett Sayles (Pexels) (Pexels)
Au 25 août, GLM-5.3-Flash avait traité environ 23,2 trillions de tokens dans la fenêtre statistique de sept jours d’OpenRouter.

À la Bourse de Hong Kong, le titre de Z.AI a clôturé à 1 160 HKD par action, en hausse de 12,6 % sur la séance et environ dix fois le prix d’offre initial de 116,20 HKD. La société, cotée sous le symbole 2513 et entrée en bourse en janvier, a annoncé tard hier avoir revendiqué la paternité d’Ox Alpha et rebaptisé le modèle GLM-5.3-Flash.

Ox Alpha était apparu anonymement la semaine dernière sur les plateformes OpenRouter et OpenCode, où il a été mis à disposition des développeurs avant que Z.AI n’en prenne officiellement la responsabilité. OpenCode a précisé que le modèle serait rendu gratuit pendant une semaine avec un quota « near-unlimited », une offre qui a suscité une vague de tests et des spéculations sur l’identité de l’acteur capable de fournir une telle capacité d’inférence.

Au 25 août, GLM-5.3-Flash avait traité environ 23,2 trillions de tokens dans la fenêtre statistique de sept jours d’OpenRouter. Sur la même période, le concurrent le plus proche, DeepSeek-V4-Flash-0731, a enregistré environ 11,6 trillions de tokens, soit moins de la moitié du volume de Z.AI. Les statistiques publiques mesurent uniquement l’usage des tokens et ne renseignent pas sur le nombre d’utilisateurs, le nombre de requêtes, les taux de réussite des tâches ni les revenus générés.

Z.AI indique que tout le trafic de requêtes a été soutenu par de la puissance de calcul utilisant des puces fabriquées en Chine, sans toutefois dévoiler quelles références techniques ont été employées. La société précise qu’il s’agissait de sa première mise à l’épreuve d’un cluster de puces chinoises à grande échelle et affirme que l’efficacité matérielle et le coût par token ont atteint des niveaux comparables à ceux des GPU Nvidia au niveau du cluster, prouvant selon elle que les puces chinoises peuvent soutenir l’inférence de modèles de pointe de façon efficace et économique.

Sur le plan produit, Z.AI affirme que GLM-5.3-Flash surpasse globalement GLM-5.2 lors de benchmarks et en usage réel, tout en ayant la moitié des paramètres de GLM-5.2. L’entreprise met en avant une tarification agressive : GLM-5.3-Flash serait facturé à seulement un dixième, voire à un vingtième pendant une offre promotionnelle limitée, et à un quarantième du tarif d’Opus 4.8 d’Anthropic selon ses déclarations.

OpenCode a ajouté que le fournisseur avait préparé une capacité de service de 100 trillions de tokens par jour pour la période de lancement, information qui a renforcé l’idée que l’infrastructure derrière GLM-5.3-Flash pouvait soutenir des volumes massifs d’appels API. L’afflux de tests sur les plateformes publiques reste le signe le plus tangible de l’intérêt immédiat de la communauté de développeurs et a alimenté l’optimisme des investisseurs.

Chiffres clés

12,6 %
Hausse quotidienne du titre
1 160 HKD
Cours de clôture par action
23,2 trillions
Tokens traités (7 jours)
100 trillions/jour
Capacité préparée

Questions fréquentes

Pourquoi le cours de Z.AI a-t-il augmenté aujourd’hui ?

Le cours a bondi après que Z.AI a revendiqué être l’auteur d’Ox Alpha et annoncé le renomage en GLM-5.3-Flash, information publiée tard hier.

Quelle est l’ampleur de l’utilisation de GLM-5.3-Flash ?

Au 25 août, GLM-5.3-Flash avait traité environ 23,2 trillions de tokens dans la fenêtre statistique de sept jours d’OpenRouter.

Sur quelle infrastructure le modèle a-t-il tourné ?

Z.AI indique que tout le trafic a été soutenu par de la puissance de calcul utilisant des puces fabriquées en Chine, sans préciser les modèles de puces.

Quel impact commercial Z.AI met-elle en avant pour GLM-5.3-Flash ?

La société affirme que GLM-5.3-Flash surpasse GLM-5.2 en benchmarks, coûte beaucoup moins et vise une tarification agressive.

Based on reporting by Yicai Global

Par Bastien Ratat

Le Courrier de la Soie