Nome oficial
O anúncio da Qwen de 3 de agosto de 2026 usa o nome Qwen3.8-Max. Ele informa 2,4 trilhões de parâmetros no total e 95 bilhões ativos. Esses números não comprovam a existência de um modelo 27B.
Qwen 3.8 · guia prático para SillyTavern
Esse nome está sendo usado para coisas diferentes. O lançamento oficial da Qwen é o Qwen3.8-Max, com 2,4 trilhões de parâmetros no total e 95 bilhões ativos. "Qwen3.8-27B" aparece em resultados da comunidade, mas não encontramos aqui um lançamento oficial nem um contrato de API da Qwen para esse rótulo. Confirme qual modelo o provedor realmente oferece antes de ajustar um preset.
Este guia separa dados oficiais de relatos da comunidade. Não ensina a contornar proteções e não afirma que o modelo está disponível em toda conta Tabbit.

Comece pelo nome certo
Muitos problemas aparecem antes da primeira mensagem: um trecho de busca, um checkpoint local e um alias hospedado acabam tratados como o mesmo contrato.
O anúncio da Qwen de 3 de agosto de 2026 usa o nome Qwen3.8-Max. Ele informa 2,4 trilhões de parâmetros no total e 95 bilhões ativos. Esses números não comprovam a existência de um modelo 27B.
"Qwen3.8-27B" aparece em posts da comunidade e trechos de busca, mas não foi confirmado aqui como checkpoint oficial da Qwen. Não baixe um arquivo nem escolha uma quantização apenas pelo nome.
O exemplo oficial usa qwen3.8-max. Um guia de terceiros também cita qwen3.8-max-preview para um canal de prévia. No SillyTavern, use o ID exato listado pelo provedor e registre o model retornado.
Um endpoint hospedado segue o protocolo e o template do provedor. Um checkpoint local usa seu próprio tokenizer e template de chat. Não cole um template da Qwen em um endpoint que já formata as mensagens.
Caminho de configuração do SillyTavern
Cartões de personagem e presets não consertam um endpoint errado. Confira a conexão e depois faça uma comparação curta de RP.
SillyTavern é um frontend dedicado a RP. Nomes de presets e comportamento do provedor pertencem a seus autores e serviços, não à nota de lançamento da Qwen.
Abra a lista atual de modelos do provedor. Se Qwen3.8-Max não estiver nela ou o ID for diferente, pare de usar um alias qwen3.8 inventado. Filtros e latência são observações do provedor.
Em uma rota compatível com OpenAI, use Chat Completions e o campo model documentado pelo provedor. Guarde a chave da API e a Base URL nas configurações do provedor, não no cartão ou no prompt.
Rotas hospedadas normalmente serializam as mensagens. Para pesos locais, use o template oficial do tokenizer quando a documentação do checkpoint o fornecer. Um template incompatível pode parecer uma falha de roleplay.
As notas oficiais da Qwen listam low, medium e xhigh, com xhigh como padrão. Comece com low ou medium para medir latência e formato, depois compare xhigh com o mesmo cartão.
Diagnóstico curto
Mantenha cartão, mensagem inicial, limite de contexto e limite de saída fixos. Mude uma variável por vez.
| O que você vê | Verifique primeiro | Pequeno ajuste |
|---|---|---|
| Modelo não encontrado ou fallback silencioso | Lista do provedor e model retornado | Copie o ID exposto e remova aliases 27B inventados. |
| Marcação ou papel aparece quebrado | Modo do endpoint e dono do template | Use o template do provedor ou o do checkpoint local, nunca os dois. |
| Raciocínio longo e pouco avanço da cena | reasoning_effort, limite de saída e tamanho do preset | Compare low/medium com xhigh e peça uma mudança concreta na cena. |
| O personagem ignora regras de formato | Tamanho, posição e ramo ativo das regras | Coloque um contrato curto de formato no fim e teste mais dois turnos. |
| Filtro ou recusa muda de provedor para provedor | Rota direta e rota de terceiros | Registre o comportamento do provedor, sem chamá-lo de fato do modelo. |
Contrato do prompt de RP
O tópico da comunidade relata tanto excesso de raciocínio quanto menor obediência ao formato. Use um contrato curto e observe os dois turnos seguintes.
Papel: Você é [personagem]. Cena: [lugar, relação, conflito atual]. Estilo: [ponto de vista, idioma, tamanho das frases]. Direção: Avance uma ação observável por turno. Não fale nem decida pelo usuário. Continuidade: Use apenas fatos confirmados; pergunte quando houver dúvida. Formato: Ação primeiro, diálogo depois. De 250 a 450 palavras. Sem resumo ou explicação das regras. Verificação: Mantenha a voz, o formato, os limites e a pista pendente do turno anterior.
Para comparar, use o mesmo cartão uma vez com o raciocínio desativado ou em low, e depois com medium ou xhigh. Anote latência, repetições, cumprimento das regras e avanço da cena.
Caminho no navegador
SillyTavern é adequado para cartões e lorebooks. Tabbit resolve outra parte: deixar wiki, página de referência ou arquivo ao lado da conversa.
Abra a ficha do personagem, a wiki do universo ou o briefing de escrita em uma aba. Você pode citá-la sem colar todos os parágrafos no prompt.
Abra o seletor de modelos do Tabbit e escolha Qwen3.8-Max apenas se ele aparecer na sua edição e conta. O seletor mostra a disponibilidade dentro do Tabbit.
Use @ para levar uma aba, captura de tela ou arquivo aberto ao contexto. Peça uma checagem de continuidade, uma reescrita curta ou uma comparação com os fatos da fonte.
Use o chat multimodelo para pedir uma segunda leitura do mesmo material. A captura mostra um fluxo real do navegador, mas não promete o mesmo acesso a modelos.

Tabbit

01
Nome oficial, data de 3 de agosto de 2026, números 2,4T e 95B e notas de raciocínio da API.

02
Use o chat multimodelo para pedir uma segunda leitura do mesmo material. A captura mostra um fluxo real do navegador, mas não promete o mesmo acesso a modelos.
Escolha o frontend
Escolha a ferramenta que cuida da parte difícil do seu fluxo. As duas permitem conversar, mas as configurações são diferentes.
| Necessidade | SillyTavern | Tabbit |
|---|---|---|
| Cartões de personagem e lorebooks | Controles próprios | Citar páginas e arquivos |
| Presets e ordem do prompt | Controle detalhado | Prompt do sistema e Skills |
| Pesquisar durante o RP | Extensões ou copiar e colar | Abas abertas viram contexto |
| Comparar modelos | Configuração do provedor ou extensões | Chat multimodelo no navegador |
| Primeiro passo | Verificar provedor, template e cartão | Abrir a fonte e conferir o seletor |
Abra as evidências
A página separa fatos oficiais sobre o modelo da experiência da comunidade. Leia as fontes antes de alterar uma configuração de longo prazo.
Perguntas frequentes
Este guia não conseguiu confirmar isso como um lançamento oficial da Qwen. O anúncio usa Qwen3.8-Max e informa 2,4T de parâmetros totais e 95B ativos. Trate 27B como um rótulo comunitário não verificado até que uma página oficial de checkpoint o confirme.
Use o ID exato retornado pelo provedor. O exemplo oficial usa qwen3.8-max; qwen3.8-max-preview aparece como rota de prévia em um guia de terceiros. Não deduza um alias a partir de um trecho de busca.
Provedores hospedados normalmente cuidam da serialização das mensagens. Pesos locais devem usar o tokenizer e o template indicado na documentação do checkpoint. Aplicar um template no frontend e outro no provedor pode corromper os papéis.
Comece com low ou medium para estabelecer uma base de latência e depois compare xhigh com o mesmo cartão. As notas oficiais listam low, medium e xhigh, com xhigh como padrão. Mais raciocínio não garante uma voz de personagem melhor.
O tópico do Reddit traz relatos de raciocínio longo e também de respostas rápidas com menor adesão ao formato. Confira separadamente provedor, tamanho do preset, reasoning_effort e posição das regras.
Somente quando ele aparecer no seletor de modelos do seu Tabbit. Se estiver disponível, mantenha aberta a página ou o arquivo do personagem e cite-o com @. A disponibilidade varia por edição, região, conta e implantação.
Instale o Tabbit para macOS ou Windows, confira o seletor de modelos e leve as referências do personagem para uma conversa no navegador.
O acesso aos modelos e as condições variam por edição e implantação.