Qwen 3.8 · guia prático para SillyTavern

Qwen 3.8 no SillyTavern

Esse nome está sendo usado para coisas diferentes. O lançamento oficial da Qwen é o Qwen3.8-Max, com 2,4 trilhões de parâmetros no total e 95 bilhões ativos. "Qwen3.8-27B" aparece em resultados da comunidade, mas não encontramos aqui um lançamento oficial nem um contrato de API da Qwen para esse rótulo. Confirme qual modelo o provedor realmente oferece antes de ajustar um preset.

Verificar o contrato do modelo

Este guia separa dados oficiais de relatos da comunidade. Não ensina a contornar proteções e não afirma que o modelo está disponível em toda conta Tabbit.

Nova aba do Tabbit com seletor de modelos e campo para citar páginas ou arquivos

Comece pelo nome certo

Três rótulos, três perguntas diferentes

Muitos problemas aparecem antes da primeira mensagem: um trecho de busca, um checkpoint local e um alias hospedado acabam tratados como o mesmo contrato.

01

Nome oficial

O anúncio da Qwen de 3 de agosto de 2026 usa o nome Qwen3.8-Max. Ele informa 2,4 trilhões de parâmetros no total e 95 bilhões ativos. Esses números não comprovam a existência de um modelo 27B.

02

A alegação de 27B

"Qwen3.8-27B" aparece em posts da comunidade e trechos de busca, mas não foi confirmado aqui como checkpoint oficial da Qwen. Não baixe um arquivo nem escolha uma quantização apenas pelo nome.

03

ID do modelo hospedado

O exemplo oficial usa qwen3.8-max. Um guia de terceiros também cita qwen3.8-max-preview para um canal de prévia. No SillyTavern, use o ID exato listado pelo provedor e registre o model retornado.

04

Local ou API

Um endpoint hospedado segue o protocolo e o template do provedor. Um checkpoint local usa seu próprio tokenizer e template de chat. Não cole um template da Qwen em um endpoint que já formata as mensagens.

Caminho de configuração do SillyTavern

Corrija o contrato antes do estilo

Cartões de personagem e presets não consertam um endpoint errado. Confira a conexão e depois faça uma comparação curta de RP.

SillyTavern é um frontend dedicado a RP. Nomes de presets e comportamento do provedor pertencem a seus autores e serviços, não à nota de lançamento da Qwen.

  1. 1. Confirme o provedor

    Abra a lista atual de modelos do provedor. Se Qwen3.8-Max não estiver nela ou o ID for diferente, pare de usar um alias qwen3.8 inventado. Filtros e latência são observações do provedor.

  2. 2. Ajuste o endpoint

    Em uma rota compatível com OpenAI, use Chat Completions e o campo model documentado pelo provedor. Guarde a chave da API e a Base URL nas configurações do provedor, não no cartão ou no prompt.

  3. 3. Deixe o template em um só lugar

    Rotas hospedadas normalmente serializam as mensagens. Para pesos locais, use o template oficial do tokenizer quando a documentação do checkpoint o fornecer. Um template incompatível pode parecer uma falha de roleplay.

  4. 4. Comece com pouco raciocínio

    As notas oficiais da Qwen listam low, medium e xhigh, com xhigh como padrão. Comece com low ou medium para medir latência e formato, depois compare xhigh com o mesmo cartão.

Diagnóstico curto

Encontre a falha em três turnos

Mantenha cartão, mensagem inicial, limite de contexto e limite de saída fixos. Mude uma variável por vez.

O que você vêVerifique primeiroPequeno ajuste
Modelo não encontrado ou fallback silenciosoLista do provedor e model retornadoCopie o ID exposto e remova aliases 27B inventados.
Marcação ou papel aparece quebradoModo do endpoint e dono do templateUse o template do provedor ou o do checkpoint local, nunca os dois.
Raciocínio longo e pouco avanço da cenareasoning_effort, limite de saída e tamanho do presetCompare low/medium com xhigh e peça uma mudança concreta na cena.
O personagem ignora regras de formatoTamanho, posição e ramo ativo das regrasColoque um contrato curto de formato no fim e teste mais dois turnos.
Filtro ou recusa muda de provedor para provedorRota direta e rota de terceirosRegistre o comportamento do provedor, sem chamá-lo de fato do modelo.

Contrato do prompt de RP

Escreva menos regras para não perdê-las

O tópico da comunidade relata tanto excesso de raciocínio quanto menor obediência ao formato. Use um contrato curto e observe os dois turnos seguintes.

Papel: Você é [personagem].
Cena: [lugar, relação, conflito atual].
Estilo: [ponto de vista, idioma, tamanho das frases].
Direção: Avance uma ação observável por turno. Não fale nem decida pelo usuário.
Continuidade: Use apenas fatos confirmados; pergunte quando houver dúvida.
Formato: Ação primeiro, diálogo depois. De 250 a 450 palavras. Sem resumo ou explicação das regras.
Verificação: Mantenha a voz, o formato, os limites e a pista pendente do turno anterior.

Para comparar, use o mesmo cartão uma vez com o raciocínio desativado ou em low, e depois com medium ou xhigh. Anote latência, repetições, cumprimento das regras e avanço da cena.

Caminho no navegador

Use Tabbit quando o material do personagem já está na web

SillyTavern é adequado para cartões e lorebooks. Tabbit resolve outra parte: deixar wiki, página de referência ou arquivo ao lado da conversa.

  1. 1

    Mantenha a fonte aberta

    Abra a ficha do personagem, a wiki do universo ou o briefing de escrita em uma aba. Você pode citá-la sem colar todos os parágrafos no prompt.

  2. 2

    Confira o seletor

    Abra o seletor de modelos do Tabbit e escolha Qwen3.8-Max apenas se ele aparecer na sua edição e conta. O seletor mostra a disponibilidade dentro do Tabbit.

  3. 3

    Cite com @

    Use @ para levar uma aba, captura de tela ou arquivo aberto ao contexto. Peça uma checagem de continuidade, uma reescrita curta ou uma comparação com os fatos da fonte.

  4. 4

    Compare sem perder a página

    Use o chat multimodelo para pedir uma segunda leitura do mesmo material. A captura mostra um fluxo real do navegador, mas não promete o mesmo acesso a modelos.

Seletor de modelos do Tabbit com modelos de chat e campo para citar páginas ou enviar arquivos

Tabbit

Cite com @

Qwen oficial: lançamento do Qwen3.8-Max

01

Qwen oficial: lançamento do Qwen3.8-Max

Nome oficial, data de 3 de agosto de 2026, números 2,4T e 95B e notas de raciocínio da API.

Seletor de modelos do Tabbit com modelos de chat e campo para citar páginas ou enviar arquivos

02

Compare sem perder a página

Use o chat multimodelo para pedir uma segunda leitura do mesmo material. A captura mostra um fluxo real do navegador, mas não promete o mesmo acesso a modelos.

Escolha o frontend

SillyTavern ou Tabbit?

Escolha a ferramenta que cuida da parte difícil do seu fluxo. As duas permitem conversar, mas as configurações são diferentes.

NecessidadeSillyTavernTabbit
Cartões de personagem e lorebooksControles própriosCitar páginas e arquivos
Presets e ordem do promptControle detalhadoPrompt do sistema e Skills
Pesquisar durante o RPExtensões ou copiar e colarAbas abertas viram contexto
Comparar modelosConfiguração do provedor ou extensõesChat multimodelo no navegador
Primeiro passoVerificar provedor, template e cartãoAbrir a fonte e conferir o seletor

Perguntas frequentes

Perguntas sobre Qwen 3.8 e SillyTavern

Qwen3.8-27B é um modelo oficial?+

Este guia não conseguiu confirmar isso como um lançamento oficial da Qwen. O anúncio usa Qwen3.8-Max e informa 2,4T de parâmetros totais e 95B ativos. Trate 27B como um rótulo comunitário não verificado até que uma página oficial de checkpoint o confirme.

Qual ID devo colocar no SillyTavern?+

Use o ID exato retornado pelo provedor. O exemplo oficial usa qwen3.8-max; qwen3.8-max-preview aparece como rota de prévia em um guia de terceiros. Não deduza um alias a partir de um trecho de busca.

Qual template de chat devo usar?+

Provedores hospedados normalmente cuidam da serialização das mensagens. Pesos locais devem usar o tokenizer e o template indicado na documentação do checkpoint. Aplicar um template no frontend e outro no provedor pode corromper os papéis.

Devo ativar o raciocínio para RP?+

Comece com low ou medium para estabelecer uma base de latência e depois compare xhigh com o mesmo cartão. As notas oficiais listam low, medium e xhigh, com xhigh como padrão. Mais raciocínio não garante uma voz de personagem melhor.

Por que o RP do Qwen 3.8 fica lento ou ignora regras?+

O tópico do Reddit traz relatos de raciocínio longo e também de respostas rápidas com menor adesão ao formato. Confira separadamente provedor, tamanho do preset, reasoning_effort e posição das regras.

Posso usar Qwen3.8-Max no Tabbit?+

Somente quando ele aparecer no seletor de modelos do seu Tabbit. Se estiver disponível, mantenha aberta a página ou o arquivo do personagem e cite-o com @. A disponibilidade varia por edição, região, conta e implantação.

Deixe a fonte ao lado da cena

Instale o Tabbit para macOS ou Windows, confira o seletor de modelos e leve as referências do personagem para uma conversa no navegador.

O acesso aos modelos e as condições variam por edição e implantação.

© 2026 Tabbit Browser. O navegador nativo de IA que entende o seu contexto.