Ox Alpha est GLM-5.3-Flash. Le nom a été dévoilé le 27 août, après une semaine pendant laquelle le modèle avait déjà traité des dépôts réels, des images, des vidéos et de longues tâches agentiques derrière une route OpenRouter anonyme.
Sous une vidéo de RandomAI, un développeur raconte avoir terminé toute une mise à niveau de version dans une seule session. C'est un témoignage, pas un benchmark. Il explique toutefois l'attention portée à cette révélation : le modèle servait déjà au travail. GLM-5.3-Flash est maintenant sélectionnable dans Tabbit Browser.
À retenir
Ox Alpha est apparu sur OpenRouter le 20 août 2026 avec un contexte d'un million de tokens et un fournisseur anonyme.
Il acceptait le texte, l'image et la vidéo, avec un positionnement code et agents de longue durée.
Le tokenizer, les budgets vidéo et les erreurs de type Z.ai ont réduit l'identité à la famille GLM avant l'annonce.
Les premiers tests sont des signaux concrets, pas un classement complet.
Dans Tabbit, Flash est surtout utile lorsque la tâche mêle raisonnement, pages, captures, documents et actions du navigateur.
Chronologie d'Ox Alpha
| Date | Information publique | Conclusion possible à ce moment-là |
|---|---|---|
| 20 août | OpenRouter publie Ox Alpha | Modèle réel, contexte 1M, développeur inconnu |
| 21 août | OpenRouter sur X confirme texte, image et vidéo | API multimodale, laboratoire inconnu |
| 21 au 25 août | Empreintes et tests communautaires | GLM devient la famille la plus probable, sans nom produit |
| 25 août | Di Zhang cite GLM-5.3-Flash | Le nom exact entre dans la discussion publique |
| 27 août | Ox Alpha est révélé comme GLM-5.3-Flash | Le nom de code rejoint l'identité produit |
Le 23 août, TechCrunch rapportait encore les pistes GLM, Microsoft MAI et d'autres hypothèses. L'incertitude était réelle avant la révélation.
Les empreintes qui pointaient vers GLM
L'analyse de Jonathan Turner a rassemblé des mesures difficiles à imiter par simple prompt.
| Signal | Résultat rapporté | Ce qu'il soutenait | Ce qu'il ne prouvait pas seul |
|---|---|---|---|
| Tokenizer | Ox et GLM-5.3 concordaient sur 50 chaînes sur 50 | Vocabulaire GLM-5.x | Poids exacts |
| Tokens vidéo | Quatre clips concordaient avec GLM-5V-Turbo | Encodeur visuel de type GLM-V | Identité avec le 5V-Turbo public |
| Erreurs service | Chemins Java et codes identiques à Z.ai PaaS v4 | Backend Z.ai | Propriété de tout le post-entraînement |
| Fiche produit | Ox avait 1M + vision, le 5.3 public était texte | GLM-5.x multimodal non publié | Nom final |
Google est passé de « qui a créé Ox Alpha » à « est-ce GLM-5.3-Flash ». La recherche montrait le débat, les mesures réduisaient le champ. Turner arrivait à la famille GLM et au service Z.ai. Di Zhang a donné le nom, puis la révélation du 27 a fermé la dernière question.
Intelligence GLM-5.2 et multimodal natif
Le billet technique de Z.ai indique que le GLM-5.3 standard utilise la même base que GLM-5.2. Les progrès viennent d'environnements exécutables, de tâches longues et de calcul supplémentaire en post-entraînement. Pour la génération précédente, consultez GLM-5.2 dans Tabbit et GLM-5.1.
GLM-5.3-Flash ajoute l'entrée multimodale native à cette lignée. Il peut lire une capture d'interface, la confronter à une spécification, puis poursuivre sur du code ou des documents.
Les scores DeepSWE ou Terminal-Bench du GLM-5.3 standard ne sont pas des scores Flash. Le checkpoint et le protocole doivent être testés séparément.
Ce que disent les tests communautaires
Wenqi/Kevin a rapporté environ 63 pour cent sur un sous-ensemble de DeepSWE, avec environ 47K tokens de sortie moyens par tâche. La liste complète, les répétitions et une soumission officielle ne sont pas publiées.
Cline a comparé Ox Alpha et Fable sur un bug réel de son dépôt. Les deux l'ont corrigé. D'après Cline, Ox répétait moins son raisonnement et utilisait environ trois fois moins de tokens de sortie. Un bug ne produit pas un classement général, mais renseigne sur l'efficacité d'action.
Notre guide du raisonnement agentique explique comment juger une boucle longue. Le roleplay et les presets relèvent du guide séparé GLM-5.3 dans SillyTavern.
Utiliser GLM-5.3-Flash dans Tabbit
Ouvrez Tabbit Browser. Utilisez Chat pour l'analyse et Agent Mode pour un travail web en plusieurs étapes.
Choisissez GLM-5.3-Flash dans le sélecteur.
Tapez
@pour joindre une page, un groupe d'onglets, une capture ou un fichier.Définissez le livrable, les vérifications et les limites.

Le guide du navigateur pour la recherche couvre les pages, PDF et graphiques. Tabbit ne remplace pas un harness de code et ne garantit pas les conditions gratuites de la préversion. Consultez les tarifs Tabbit.
Choisir selon la tâche
| Tâche | Adéquation | Méthode | Limite |
|---|---|---|---|
| Comparer capture UI et spécification | Forte | Joindre les deux et demander des écarts vérifiables | Garder sources et preuves visuelles |
| Recherche avec pages, graphiques et PDF | Forte | Grouper les sources et exiger des citations | Éviter les longs résumés non sourcés |
| Flux navigateur avec état visuel | Forte | Lancer Agent dans un groupe séparé | Relire les modifications |
| Gros patch de dépôt | Mixte | Tabbit pour les documents, harness pour code et tests | Ne remplace pas git ni CI |
| Question texte simple | Correcte | Chat sans pièce jointe | Un petit modèle peut être plus rapide |
GLM-5.3-Flash est intéressant lorsque le raisonnement long de GLM rencontre un contexte visuel. Les données initiales justifient un essai sur un vrai travail agentique, pas le transfert de tous les scores GLM-5.3 ni un verdict universel. Pour un autre modèle à long contexte, voyez le guide GPT-5.6 Sol 1M.
Questions fréquentes
Ox Alpha est-il vraiment GLM-5.3-Flash ?
Oui. Le 27 août 2026, Ox Alpha a été révélé comme GLM-5.3-Flash. Avant cette date, OpenRouter ne l'affichait que sous la forme de la préversion anonyme stealth/ox-alpha, même si le tokenizer, les budgets vidéo et les erreurs serveur pointaient déjà vers GLM et l'infrastructure Z.ai.
GLM-5.3-Flash est-il identique à GLM-5.3 ?
Non. Le GLM-5.3 standard est un modèle texte destiné au code et aux agents de longue durée. GLM-5.3-Flash prolonge cette lignée d'intelligence et ajoute des entrées natives texte, image et vidéo. Ses scores doivent être mesurés séparément.
Que reçoit GLM-5.3-Flash de GLM-5.2 ?
Z.ai explique que le GLM-5.3 standard utilise le même modèle de base que GLM-5.2 et progresse grâce au post-entraînement. Cette lignée vise le code, les outils et les tâches longues. Flash la combine avec une entrée multimodale native.
Quelles entrées Ox Alpha acceptait-il en préversion ?
OpenRouter indiquait un contexte d'un million de tokens et des entrées texte, image et vidéo, avec une sortie texte. Le modèle visait le code, le travail agentique continu et les charges de production. La gratuité de la préversion n'était pas une promesse durable.
Les premiers tests d'Ox Alpha étaient-ils bons ?
Ils sont encourageants mais incomplets. Wenqi/Kevin a rapporté environ 63 pour cent sur un sous-ensemble de DeepSWE, tandis que Cline a décrit un bug réel corrigé avec environ trois fois moins de tokens de sortie que Fable.
Comment utiliser GLM-5.3-Flash dans Tabbit ?
Ouvrez Tabbit Browser, lancez un Chat ou une tâche Agent, puis choisissez GLM-5.3-Flash. Tapez @ pour joindre la page active, un groupe d'onglets, une capture ou un fichier local. Vérifiez le sélecteur et la page des tarifs pour la disponibilité et les limites actuelles.