TabbitBlog

Ox Alpha revelado como GLM-5.3-Flash

Ox Alpha é o GLM-5.3-Flash. Veja o preview anônimo, as impressões digitais, os testes públicos, a multimodalidade nativa e como usá-lo no Tabbit.

Neste artigo
  1. Principais conclusões
  2. Linha do tempo do Ox Alpha
  3. As impressões digitais que apontavam para GLM
  4. Inteligência do GLM-5.2 com multimodalidade nativa
  5. O que os testes da comunidade dizem
  6. Usar GLM-5.3-Flash no Tabbit
  7. Escolha por tarefa

Ox Alpha é o GLM-5.3-Flash. O nome foi revelado em 27 de agosto, depois de uma semana em que o modelo já havia trabalhado com repositórios reais, imagens, vídeos e tarefas longas de agentes por uma rota anônima do OpenRouter.

Nos comentários de um vídeo do RandomAI, um desenvolvedor disse ter concluído todo o fluxo de atualização de versão em uma única sessão. É uma experiência individual, não um benchmark. Mesmo assim, explica o interesse: as pessoas já usavam o modelo no trabalho. Agora o GLM-5.3-Flash também pode ser escolhido no Tabbit Browser.

Principais conclusões

  • Ox Alpha apareceu no OpenRouter em 20 de agosto de 2026, com um milhão de tokens de contexto e fornecedor anônimo.

  • Aceitava texto, imagem e vídeo e foi apresentado para programação e agentes de longa duração.

  • Tokenizer, tokens de vídeo e erros no estilo Z.ai reduziram a identidade à família GLM antes do anúncio.

  • Os primeiros testes são sinais concretos, não um ranking completo.

  • No Tabbit, Flash é mais útil quando a tarefa mistura raciocínio, páginas, capturas, documentos e ações do navegador.

Linha do tempo do Ox Alpha

DataInformação públicaConclusão possível naquele momento
20 ago.OpenRouter publicou Ox AlphaModelo real, contexto 1M, criador desconhecido
21 ago.OpenRouter no X confirmou texto, imagem e vídeoAPI multimodal, laboratório desconhecido
21 a 25 ago.Impressões digitais e testes da comunidadeGLM virou a família mais provável, sem nome do produto
25 ago.Di Zhang citou GLM-5.3-FlashO nome exato entrou no debate público
27 ago.Ox Alpha foi revelado como GLM-5.3-FlashCodinome e identidade do produto se encontraram

Em 23 de agosto, a TechCrunch ainda registrava hipóteses sobre GLM, Microsoft MAI e outros modelos. A incerteza antes da revelação era real.

As impressões digitais que apontavam para GLM

A análise de Jonathan Turner reuniu medições difíceis de imitar apenas com prompt.

SinalResultado relatadoO que sustentavaO que não provava sozinho
TokenizerOx e GLM-5.3 coincidiram em 50 de 50 stringsVocabulário GLM-5.xPesos exatos
Tokens de vídeoQuatro clipes coincidiram com GLM-5V-TurboEncoder visual do tipo GLM-VQue fosse o 5V-Turbo público
Erros do serviçoCaminhos Java e códigos coincidiram com Z.ai PaaS v4Backend Z.aiDono de todo o pós-treinamento
Ficha do produtoOx tinha 1M + visão, o 5.3 público era textoGLM-5.x multimodal não publicadoNome final

O Google passou de "quem fez Ox Alpha" para "é GLM-5.3-Flash". A busca mostrou a discussão, enquanto as medições estreitaram o campo. Turner chegou à família GLM e ao serviço Z.ai. Di Zhang deu o nome; a revelação do dia 27 fechou a última lacuna.

Inteligência do GLM-5.2 com multimodalidade nativa

O artigo técnico da Z.ai afirma que o GLM-5.3 padrão usa a mesma base do GLM-5.2. Os ganhos vieram de ambientes executáveis, tarefas longas e mais pós-treinamento. Para a geração anterior, veja GLM-5.2 no Tabbit e GLM-5.1.

GLM-5.3-Flash adiciona entrada multimodal nativa a essa linha. Ele pode ler uma captura de interface, compará-la com uma especificação e continuar o raciocínio em código ou documentos.

Os números do DeepSWE ou Terminal-Bench do GLM-5.3 padrão não são resultados do Flash. O checkpoint e o protocolo precisam ser testados separadamente.

O que os testes da comunidade dizem

Wenqi/Kevin relatou cerca de 63 por cento em um subconjunto do DeepSWE, com aproximadamente 47K tokens de saída por tarefa. A lista completa, as repetições e uma submissão oficial não foram publicadas.

Cline comparou Ox Alpha e Fable em um bug real do próprio repositório. Ambos corrigiram o bug. Segundo a Cline, Ox repetiu menos o raciocínio e usou cerca de três vezes menos tokens de saída. Um bug não cria ranking geral, mas mostra eficiência de ação.

Nosso guia de raciocínio agentic explica como avaliar um ciclo longo. Roleplay e presets ficam no guia separado de GLM-5.3 no SillyTavern.

Usar GLM-5.3-Flash no Tabbit

  1. Abra o Tabbit Browser. Use Chat para análise e Agent Mode para trabalho web em várias etapas.

  2. Escolha GLM-5.3-Flash no seletor.

  3. Digite @ para anexar página, grupo de abas, captura ou arquivo.

  4. Defina a entrega, as verificações e os limites.

Interface multimodelo do Tabbit com GPT, Claude, Kimi, Qwen e GLM em paralelo
O Tabbit mostra várias famílias em paralelo. Esta interface anterior exibe GLM-5.2; GLM-5.3-Flash usa o mesmo fluxo de seleção.

O guia de navegador para pesquisa cobre páginas, PDFs e gráficos. O Tabbit não substitui um harness de código nem garante as condições gratuitas do preview. Consulte os preços do Tabbit.

Escolha por tarefa

TarefaAdequaçãoMétodoLimite
Comparar captura de UI e especificaçãoAltaAnexar ambas e pedir diferenças verificáveisManter fontes e evidência visual
Pesquisa com páginas, gráficos e PDFsAltaAgrupar fontes e exigir citaçõesEvitar resumos sem fonte
Fluxo de navegador com estado visualAltaExecutar Agent em grupo separadoRevisar mudanças
Patch grande em repositórioMistaTabbit para documentos, harness para código e testesNão substitui git e CI
Pergunta simples de textoAceitávelChat sem anexosUm modelo menor pode ser mais rápido

GLM-5.3-Flash faz sentido quando o raciocínio longo do GLM encontra contexto visual. Os primeiros dados justificam testá-lo em trabalho agentic real, não transferir todos os resultados do GLM-5.3 nem declará-lo vencedor universal. Para outro modelo de contexto longo, veja o guia GPT-5.6 Sol 1M.

Perguntas frequentes

Ox Alpha é mesmo o GLM-5.3-Flash?

Sim. Em 27 de agosto de 2026, Ox Alpha foi revelado como GLM-5.3-Flash. Antes disso, o OpenRouter o listava apenas como o preview anônimo stealth/ox-alpha, embora tokenizer, orçamento de tokens de vídeo e erros do servidor já apontassem para GLM e para a infraestrutura da Z.ai.

GLM-5.3-Flash é igual ao GLM-5.3?

Não. O GLM-5.3 padrão foi lançado como modelo de texto para programação e trabalho prolongado de agentes. O GLM-5.3-Flash continua essa linha de inteligência e adiciona entrada nativa de texto, imagem e vídeo. Os resultados precisam ser medidos separadamente.

O que o GLM-5.3-Flash herda do GLM-5.2?

A Z.ai diz que o GLM-5.3 padrão usa o mesmo modelo-base do GLM-5.2 e melhora com mais pós-treinamento. Essa linha mira programação, ferramentas e tarefas longas. O Flash combina essa base com entrada multimodal nativa.

Quais entradas o preview do Ox Alpha aceitava?

O OpenRouter indicava contexto de um milhão de tokens e entrada de texto, imagem e vídeo, com saída de texto. O modelo era voltado a programação, trabalho contínuo de agentes e cargas de produção. O preview gratuito não era uma condição permanente.

Os primeiros testes do Ox Alpha foram bons?

Foram sinais promissores, mas incompletos. Wenqi/Kevin relatou cerca de 63 por cento em um subconjunto do DeepSWE, enquanto a Cline descreveu um bug real corrigido com aproximadamente três vezes menos tokens de saída que o Fable.

Como usar GLM-5.3-Flash no Tabbit?

Abra o Tabbit Browser, inicie um Chat ou tarefa Agent e escolha GLM-5.3-Flash. Digite @ para anexar a página atual, um grupo de abas, uma captura ou um arquivo local. Confira o seletor e a página de preços para disponibilidade e limites atuais.

Dê o próximo passo

Deixe o Tabbit trabalhar ao seu lado.

Pesquise entre abas, automatize o trabalho repetitivo do navegador e mantenha todo o contexto ao alcance.