Ox Alpha é o GLM-5.3-Flash. O nome foi revelado em 27 de agosto, depois de uma semana em que o modelo já havia trabalhado com repositórios reais, imagens, vídeos e tarefas longas de agentes por uma rota anônima do OpenRouter.
Nos comentários de um vídeo do RandomAI, um desenvolvedor disse ter concluído todo o fluxo de atualização de versão em uma única sessão. É uma experiência individual, não um benchmark. Mesmo assim, explica o interesse: as pessoas já usavam o modelo no trabalho. Agora o GLM-5.3-Flash também pode ser escolhido no Tabbit Browser.
Principais conclusões
Ox Alpha apareceu no OpenRouter em 20 de agosto de 2026, com um milhão de tokens de contexto e fornecedor anônimo.
Aceitava texto, imagem e vídeo e foi apresentado para programação e agentes de longa duração.
Tokenizer, tokens de vídeo e erros no estilo Z.ai reduziram a identidade à família GLM antes do anúncio.
Os primeiros testes são sinais concretos, não um ranking completo.
No Tabbit, Flash é mais útil quando a tarefa mistura raciocínio, páginas, capturas, documentos e ações do navegador.
Linha do tempo do Ox Alpha
| Data | Informação pública | Conclusão possível naquele momento |
|---|---|---|
| 20 ago. | OpenRouter publicou Ox Alpha | Modelo real, contexto 1M, criador desconhecido |
| 21 ago. | OpenRouter no X confirmou texto, imagem e vídeo | API multimodal, laboratório desconhecido |
| 21 a 25 ago. | Impressões digitais e testes da comunidade | GLM virou a família mais provável, sem nome do produto |
| 25 ago. | Di Zhang citou GLM-5.3-Flash | O nome exato entrou no debate público |
| 27 ago. | Ox Alpha foi revelado como GLM-5.3-Flash | Codinome e identidade do produto se encontraram |
Em 23 de agosto, a TechCrunch ainda registrava hipóteses sobre GLM, Microsoft MAI e outros modelos. A incerteza antes da revelação era real.
As impressões digitais que apontavam para GLM
A análise de Jonathan Turner reuniu medições difíceis de imitar apenas com prompt.
| Sinal | Resultado relatado | O que sustentava | O que não provava sozinho |
|---|---|---|---|
| Tokenizer | Ox e GLM-5.3 coincidiram em 50 de 50 strings | Vocabulário GLM-5.x | Pesos exatos |
| Tokens de vídeo | Quatro clipes coincidiram com GLM-5V-Turbo | Encoder visual do tipo GLM-V | Que fosse o 5V-Turbo público |
| Erros do serviço | Caminhos Java e códigos coincidiram com Z.ai PaaS v4 | Backend Z.ai | Dono de todo o pós-treinamento |
| Ficha do produto | Ox tinha 1M + visão, o 5.3 público era texto | GLM-5.x multimodal não publicado | Nome final |
O Google passou de "quem fez Ox Alpha" para "é GLM-5.3-Flash". A busca mostrou a discussão, enquanto as medições estreitaram o campo. Turner chegou à família GLM e ao serviço Z.ai. Di Zhang deu o nome; a revelação do dia 27 fechou a última lacuna.
Inteligência do GLM-5.2 com multimodalidade nativa
O artigo técnico da Z.ai afirma que o GLM-5.3 padrão usa a mesma base do GLM-5.2. Os ganhos vieram de ambientes executáveis, tarefas longas e mais pós-treinamento. Para a geração anterior, veja GLM-5.2 no Tabbit e GLM-5.1.
GLM-5.3-Flash adiciona entrada multimodal nativa a essa linha. Ele pode ler uma captura de interface, compará-la com uma especificação e continuar o raciocínio em código ou documentos.
Os números do DeepSWE ou Terminal-Bench do GLM-5.3 padrão não são resultados do Flash. O checkpoint e o protocolo precisam ser testados separadamente.
O que os testes da comunidade dizem
Wenqi/Kevin relatou cerca de 63 por cento em um subconjunto do DeepSWE, com aproximadamente 47K tokens de saída por tarefa. A lista completa, as repetições e uma submissão oficial não foram publicadas.
Cline comparou Ox Alpha e Fable em um bug real do próprio repositório. Ambos corrigiram o bug. Segundo a Cline, Ox repetiu menos o raciocínio e usou cerca de três vezes menos tokens de saída. Um bug não cria ranking geral, mas mostra eficiência de ação.
Nosso guia de raciocínio agentic explica como avaliar um ciclo longo. Roleplay e presets ficam no guia separado de GLM-5.3 no SillyTavern.
Usar GLM-5.3-Flash no Tabbit
Abra o Tabbit Browser. Use Chat para análise e Agent Mode para trabalho web em várias etapas.
Escolha GLM-5.3-Flash no seletor.
Digite
@para anexar página, grupo de abas, captura ou arquivo.Defina a entrega, as verificações e os limites.

O guia de navegador para pesquisa cobre páginas, PDFs e gráficos. O Tabbit não substitui um harness de código nem garante as condições gratuitas do preview. Consulte os preços do Tabbit.
Escolha por tarefa
| Tarefa | Adequação | Método | Limite |
|---|---|---|---|
| Comparar captura de UI e especificação | Alta | Anexar ambas e pedir diferenças verificáveis | Manter fontes e evidência visual |
| Pesquisa com páginas, gráficos e PDFs | Alta | Agrupar fontes e exigir citações | Evitar resumos sem fonte |
| Fluxo de navegador com estado visual | Alta | Executar Agent em grupo separado | Revisar mudanças |
| Patch grande em repositório | Mista | Tabbit para documentos, harness para código e testes | Não substitui git e CI |
| Pergunta simples de texto | Aceitável | Chat sem anexos | Um modelo menor pode ser mais rápido |
GLM-5.3-Flash faz sentido quando o raciocínio longo do GLM encontra contexto visual. Os primeiros dados justificam testá-lo em trabalho agentic real, não transferir todos os resultados do GLM-5.3 nem declará-lo vencedor universal. Para outro modelo de contexto longo, veja o guia GPT-5.6 Sol 1M.
Perguntas frequentes
Ox Alpha é mesmo o GLM-5.3-Flash?
Sim. Em 27 de agosto de 2026, Ox Alpha foi revelado como GLM-5.3-Flash. Antes disso, o OpenRouter o listava apenas como o preview anônimo stealth/ox-alpha, embora tokenizer, orçamento de tokens de vídeo e erros do servidor já apontassem para GLM e para a infraestrutura da Z.ai.
GLM-5.3-Flash é igual ao GLM-5.3?
Não. O GLM-5.3 padrão foi lançado como modelo de texto para programação e trabalho prolongado de agentes. O GLM-5.3-Flash continua essa linha de inteligência e adiciona entrada nativa de texto, imagem e vídeo. Os resultados precisam ser medidos separadamente.
O que o GLM-5.3-Flash herda do GLM-5.2?
A Z.ai diz que o GLM-5.3 padrão usa o mesmo modelo-base do GLM-5.2 e melhora com mais pós-treinamento. Essa linha mira programação, ferramentas e tarefas longas. O Flash combina essa base com entrada multimodal nativa.
Quais entradas o preview do Ox Alpha aceitava?
O OpenRouter indicava contexto de um milhão de tokens e entrada de texto, imagem e vídeo, com saída de texto. O modelo era voltado a programação, trabalho contínuo de agentes e cargas de produção. O preview gratuito não era uma condição permanente.
Os primeiros testes do Ox Alpha foram bons?
Foram sinais promissores, mas incompletos. Wenqi/Kevin relatou cerca de 63 por cento em um subconjunto do DeepSWE, enquanto a Cline descreveu um bug real corrigido com aproximadamente três vezes menos tokens de saída que o Fable.
Como usar GLM-5.3-Flash no Tabbit?
Abra o Tabbit Browser, inicie um Chat ou tarefa Agent e escolha GLM-5.3-Flash. Digite @ para anexar a página atual, um grupo de abas, uma captura ou um arquivo local. Confira o seletor e a página de preços para disponibilidade e limites atuais.