TabbitBlog

Ox Alpha révélé comme GLM-5.3-Flash

Ox Alpha est GLM-5.3-Flash. La préversion anonyme, les empreintes techniques et les tests publics expliquent son multimodal natif et son usage dans Tabbit.

Dans cet article
  1. À retenir
  2. Chronologie d'Ox Alpha
  3. Les empreintes qui pointaient vers GLM
  4. Intelligence GLM-5.2 et multimodal natif
  5. Ce que disent les tests communautaires
  6. Utiliser GLM-5.3-Flash dans Tabbit
  7. Choisir selon la tâche

Ox Alpha est GLM-5.3-Flash. Le nom a été dévoilé le 27 août, après une semaine pendant laquelle le modèle avait déjà traité des dépôts réels, des images, des vidéos et de longues tâches agentiques derrière une route OpenRouter anonyme.

Sous une vidéo de RandomAI, un développeur raconte avoir terminé toute une mise à niveau de version dans une seule session. C'est un témoignage, pas un benchmark. Il explique toutefois l'attention portée à cette révélation : le modèle servait déjà au travail. GLM-5.3-Flash est maintenant sélectionnable dans Tabbit Browser.

À retenir

  • Ox Alpha est apparu sur OpenRouter le 20 août 2026 avec un contexte d'un million de tokens et un fournisseur anonyme.

  • Il acceptait le texte, l'image et la vidéo, avec un positionnement code et agents de longue durée.

  • Le tokenizer, les budgets vidéo et les erreurs de type Z.ai ont réduit l'identité à la famille GLM avant l'annonce.

  • Les premiers tests sont des signaux concrets, pas un classement complet.

  • Dans Tabbit, Flash est surtout utile lorsque la tâche mêle raisonnement, pages, captures, documents et actions du navigateur.

Chronologie d'Ox Alpha

DateInformation publiqueConclusion possible à ce moment-là
20 aoûtOpenRouter publie Ox AlphaModèle réel, contexte 1M, développeur inconnu
21 aoûtOpenRouter sur X confirme texte, image et vidéoAPI multimodale, laboratoire inconnu
21 au 25 aoûtEmpreintes et tests communautairesGLM devient la famille la plus probable, sans nom produit
25 aoûtDi Zhang cite GLM-5.3-FlashLe nom exact entre dans la discussion publique
27 aoûtOx Alpha est révélé comme GLM-5.3-FlashLe nom de code rejoint l'identité produit

Le 23 août, TechCrunch rapportait encore les pistes GLM, Microsoft MAI et d'autres hypothèses. L'incertitude était réelle avant la révélation.

Les empreintes qui pointaient vers GLM

L'analyse de Jonathan Turner a rassemblé des mesures difficiles à imiter par simple prompt.

SignalRésultat rapportéCe qu'il soutenaitCe qu'il ne prouvait pas seul
TokenizerOx et GLM-5.3 concordaient sur 50 chaînes sur 50Vocabulaire GLM-5.xPoids exacts
Tokens vidéoQuatre clips concordaient avec GLM-5V-TurboEncodeur visuel de type GLM-VIdentité avec le 5V-Turbo public
Erreurs serviceChemins Java et codes identiques à Z.ai PaaS v4Backend Z.aiPropriété de tout le post-entraînement
Fiche produitOx avait 1M + vision, le 5.3 public était texteGLM-5.x multimodal non publiéNom final

Google est passé de « qui a créé Ox Alpha » à « est-ce GLM-5.3-Flash ». La recherche montrait le débat, les mesures réduisaient le champ. Turner arrivait à la famille GLM et au service Z.ai. Di Zhang a donné le nom, puis la révélation du 27 a fermé la dernière question.

Intelligence GLM-5.2 et multimodal natif

Le billet technique de Z.ai indique que le GLM-5.3 standard utilise la même base que GLM-5.2. Les progrès viennent d'environnements exécutables, de tâches longues et de calcul supplémentaire en post-entraînement. Pour la génération précédente, consultez GLM-5.2 dans Tabbit et GLM-5.1.

GLM-5.3-Flash ajoute l'entrée multimodale native à cette lignée. Il peut lire une capture d'interface, la confronter à une spécification, puis poursuivre sur du code ou des documents.

Les scores DeepSWE ou Terminal-Bench du GLM-5.3 standard ne sont pas des scores Flash. Le checkpoint et le protocole doivent être testés séparément.

Ce que disent les tests communautaires

Wenqi/Kevin a rapporté environ 63 pour cent sur un sous-ensemble de DeepSWE, avec environ 47K tokens de sortie moyens par tâche. La liste complète, les répétitions et une soumission officielle ne sont pas publiées.

Cline a comparé Ox Alpha et Fable sur un bug réel de son dépôt. Les deux l'ont corrigé. D'après Cline, Ox répétait moins son raisonnement et utilisait environ trois fois moins de tokens de sortie. Un bug ne produit pas un classement général, mais renseigne sur l'efficacité d'action.

Notre guide du raisonnement agentique explique comment juger une boucle longue. Le roleplay et les presets relèvent du guide séparé GLM-5.3 dans SillyTavern.

Utiliser GLM-5.3-Flash dans Tabbit

  1. Ouvrez Tabbit Browser. Utilisez Chat pour l'analyse et Agent Mode pour un travail web en plusieurs étapes.

  2. Choisissez GLM-5.3-Flash dans le sélecteur.

  3. Tapez @ pour joindre une page, un groupe d'onglets, une capture ou un fichier.

  4. Définissez le livrable, les vérifications et les limites.

Interface multimodèle Tabbit avec GPT, Claude, Kimi, Qwen et GLM en parallèle
Tabbit affiche plusieurs familles en parallèle. Cette interface antérieure montre GLM-5.2; GLM-5.3-Flash suit le même flux de sélection.

Le guide du navigateur pour la recherche couvre les pages, PDF et graphiques. Tabbit ne remplace pas un harness de code et ne garantit pas les conditions gratuites de la préversion. Consultez les tarifs Tabbit.

Choisir selon la tâche

TâcheAdéquationMéthodeLimite
Comparer capture UI et spécificationForteJoindre les deux et demander des écarts vérifiablesGarder sources et preuves visuelles
Recherche avec pages, graphiques et PDFForteGrouper les sources et exiger des citationsÉviter les longs résumés non sourcés
Flux navigateur avec état visuelForteLancer Agent dans un groupe séparéRelire les modifications
Gros patch de dépôtMixteTabbit pour les documents, harness pour code et testsNe remplace pas git ni CI
Question texte simpleCorrecteChat sans pièce jointeUn petit modèle peut être plus rapide

GLM-5.3-Flash est intéressant lorsque le raisonnement long de GLM rencontre un contexte visuel. Les données initiales justifient un essai sur un vrai travail agentique, pas le transfert de tous les scores GLM-5.3 ni un verdict universel. Pour un autre modèle à long contexte, voyez le guide GPT-5.6 Sol 1M.

Questions fréquentes

Ox Alpha est-il vraiment GLM-5.3-Flash ?

Oui. Le 27 août 2026, Ox Alpha a été révélé comme GLM-5.3-Flash. Avant cette date, OpenRouter ne l'affichait que sous la forme de la préversion anonyme stealth/ox-alpha, même si le tokenizer, les budgets vidéo et les erreurs serveur pointaient déjà vers GLM et l'infrastructure Z.ai.

GLM-5.3-Flash est-il identique à GLM-5.3 ?

Non. Le GLM-5.3 standard est un modèle texte destiné au code et aux agents de longue durée. GLM-5.3-Flash prolonge cette lignée d'intelligence et ajoute des entrées natives texte, image et vidéo. Ses scores doivent être mesurés séparément.

Que reçoit GLM-5.3-Flash de GLM-5.2 ?

Z.ai explique que le GLM-5.3 standard utilise le même modèle de base que GLM-5.2 et progresse grâce au post-entraînement. Cette lignée vise le code, les outils et les tâches longues. Flash la combine avec une entrée multimodale native.

Quelles entrées Ox Alpha acceptait-il en préversion ?

OpenRouter indiquait un contexte d'un million de tokens et des entrées texte, image et vidéo, avec une sortie texte. Le modèle visait le code, le travail agentique continu et les charges de production. La gratuité de la préversion n'était pas une promesse durable.

Les premiers tests d'Ox Alpha étaient-ils bons ?

Ils sont encourageants mais incomplets. Wenqi/Kevin a rapporté environ 63 pour cent sur un sous-ensemble de DeepSWE, tandis que Cline a décrit un bug réel corrigé avec environ trois fois moins de tokens de sortie que Fable.

Comment utiliser GLM-5.3-Flash dans Tabbit ?

Ouvrez Tabbit Browser, lancez un Chat ou une tâche Agent, puis choisissez GLM-5.3-Flash. Tapez @ pour joindre la page active, un groupe d'onglets, une capture ou un fichier local. Vérifiez le sélecteur et la page des tarifs pour la disponibilité et les limites actuelles.

Passez à la suite

Laissez Tabbit travailler à vos côtés.

Faites des recherches entre les onglets, automatisez les tâches répétitives du navigateur et gardez chaque élément de contexte à portée de main.