Qwen 3.8 · guía práctica para SillyTavern

Qwen 3.8 en SillyTavern

El nombre se usa para cosas distintas. El lanzamiento oficial de Qwen es Qwen3.8-Max, con 2,4 billones de parámetros totales y 95 mil millones activos. "Qwen3.8-27B" aparece en resultados de la comunidad, pero aquí no encontramos un lanzamiento oficial ni un contrato de API de Qwen para esa etiqueta. Comprueba qué modelo expone realmente tu proveedor antes de ajustar un preset.

Comprobar el contrato del modelo

Esta guía separa los datos oficiales de los informes de la comunidad. No explica cómo saltarse medidas de seguridad ni promete el modelo en todas las cuentas de Tabbit.

Nueva pestaña de Tabbit con selector de modelos y un campo para citar páginas o archivos

Primero, usa el nombre correcto

Tres etiquetas, tres preguntas distintas

Muchos fallos aparecen antes del primer mensaje: un fragmento de búsqueda, un checkpoint local y un alias alojado se tratan como si fueran el mismo contrato.

01

Nombre oficial

El anuncio de Qwen del 3 de agosto de 2026 llama al modelo Qwen3.8-Max. Indica 2,4 billones de parámetros totales y 95 mil millones activos. Esas cifras no prueban que exista un modelo de 27B.

02

La afirmación de 27B

La etiqueta "Qwen3.8-27B" aparece en publicaciones de la comunidad y fragmentos de búsqueda, pero aquí no se ha verificado como checkpoint oficial de Qwen. No descargues un archivo ni elijas una cuantización basándote solo en el nombre.

03

ID del modelo alojado

El ejemplo oficial usa qwen3.8-max. Una guía de terceros también menciona qwen3.8-max-preview para un canal de prueba. En SillyTavern, usa el ID exacto de tu proveedor y anota el model que devuelve.

04

Local frente a API

Un endpoint alojado usa el protocolo y la plantilla de su proveedor. Un checkpoint local usa su propio tokenizer y su propia plantilla de chat. No pegues una plantilla de Qwen en un endpoint que ya serializa los mensajes.

Ruta de configuración de SillyTavern

Corrige el contrato antes de pulir el texto

Las tarjetas de personaje y los presets no arreglan un endpoint equivocado. Revisa primero la conexión y después haz una comparación breve de RP.

SillyTavern es un frontend especializado en RP. Los nombres de los presets y el comportamiento del proveedor pertenecen a sus autores y servicios, no a la nota de lanzamiento de Qwen.

  1. 1. Confirma el proveedor

    Abre la lista actual de modelos del proveedor. Si no incluye Qwen3.8-Max o muestra otro ID, deja de usar un alias qwen3.8 inventado. Los filtros y la latencia son observaciones del proveedor.

  2. 2. Ajusta el endpoint

    Para una ruta compatible con OpenAI, usa Chat Completions y el campo model que documenta el proveedor. Guarda la clave y la Base URL en los ajustes del proveedor, no en la tarjeta ni en el prompt.

  3. 3. Deja la plantilla en un solo sitio

    Las rutas alojadas suelen serializar los mensajes. Con pesos locales, usa la plantilla oficial del tokenizer cuando la documentación del checkpoint la indique. Una plantilla incorrecta puede parecer un problema de roleplay.

  4. 4. Empieza con poco razonamiento

    Las notas oficiales de Qwen indican low, medium y xhigh, con xhigh como valor predeterminado. Empieza con low o medium para medir latencia y formato; después compara xhigh con la misma tarjeta.

Diagnóstico breve

Encuentra el fallo en tres turnos

Mantén fija la tarjeta, el mensaje inicial, el límite de contexto y el máximo de salida. Cambia una sola variable cada vez.

Lo que vesComprueba primeroAjuste pequeño
Modelo no encontrado o fallback silenciosoLista del proveedor y model devueltoCopia el ID expuesto y elimina los alias 27B inventados.
El marcado o el rol se ve rotoModo del endpoint y dueño de la plantillaUsa la plantilla del proveedor o la del checkpoint local, nunca las dos.
Mucho razonamiento y poco avancereasoning_effort, límite de salida y longitud del presetCompara low/medium con xhigh y pide un cambio concreto en la escena.
El personaje ignora las reglas de formatoLongitud, posición y rama activa de las reglasPon un contrato de formato corto al final y prueba dos turnos más.
El filtro o el rechazo cambia según el proveedorRuta directa frente a ruta de tercerosRegistra el comportamiento del proveedor; no lo presentes como un hecho del modelo.

Contrato del prompt de RP

Escribe menos reglas para que no se pierdan

El hilo de la comunidad recoge tanto exceso de razonamiento como menor obediencia al formato. Usa un contrato corto y observa los dos turnos siguientes.

Rol: Eres [personaje].
Escena: [lugar, relación, conflicto actual].
Estilo: [punto de vista, idioma, longitud de frase].
Dirección: Avanza una acción observable por turno. No hables ni decidas por el usuario.
Continuidad: Usa solo hechos confirmados; pregunta si hay duda.
Formato: Primero la acción y después el diálogo. De 250 a 450 palabras. Sin resumen ni explicación de reglas.
Comprobación: Conserva la voz, el formato, los límites y la pista pendiente del turno anterior.

Para comparar, usa la misma tarjeta una vez con el razonamiento desactivado o en low, y otra con medium o xhigh. Guarda la latencia, los detalles repetidos, el cumplimiento y el avance de la escena.

Ruta en el navegador

Usa Tabbit cuando el material del personaje ya está en la web

SillyTavern funciona bien con tarjetas y libros de lore. Tabbit resuelve otra parte: mantener una wiki, una página de referencia o un archivo junto a la conversación.

  1. 1

    Mantén abierta la fuente

    Abre la ficha del personaje, la wiki del mundo o el brief de escritura en una pestaña. Puedes citarla sin pegar cada párrafo en el prompt.

  2. 2

    Mira el selector

    Abre el selector de modelos de Tabbit y elige Qwen3.8-Max solo si aparece en tu edición y cuenta. Ese selector indica qué modelos tiene disponibles Tabbit.

  3. 3

    Cita con @

    Usa @ para llevar una pestaña, captura o archivo abierto al contexto. Pide una revisión de continuidad, una reescritura breve o una comparación con los hechos de la fuente.

  4. 4

    Compara sin cerrar la página

    Usa el chat multimodelo para pedir una segunda lectura del mismo material. La captura muestra un flujo real del navegador, no garantiza el mismo acceso a modelos.

Selector de modelos de Tabbit con modelos de chat y un campo para citar páginas o subir archivos

Tabbit

Cita con @

Qwen oficial: lanzamiento de Qwen3.8-Max

01

Qwen oficial: lanzamiento de Qwen3.8-Max

Nombre oficial, fecha del 3 de agosto de 2026, cifras de 2,4T y 95B, y notas de razonamiento en la API.

Selector de modelos de Tabbit con modelos de chat y un campo para citar páginas o subir archivos

02

Compara sin cerrar la página

Usa el chat multimodelo para pedir una segunda lectura del mismo material. La captura muestra un flujo real del navegador, no garantiza el mismo acceso a modelos.

Elige el frontend

¿SillyTavern o Tabbit?

Elige la herramienta que controla la parte difícil de tu flujo. Ambos permiten chatear, pero sus ajustes no son iguales.

NecesidadSillyTavernTabbit
Tarjetas y libros de loreControles dedicadosCitar páginas y archivos
Presets y orden del promptControl detalladoPrompt del sistema y Skills
Investigar junto al RPExtensiones o copiar y pegarLas pestañas abiertas son contexto
Comparar modelosAjustes del proveedor o extensionesChat multimodelo en el navegador
Primer pasoVerificar proveedor, plantilla y tarjetaAbrir la fuente y revisar el selector

Preguntas frecuentes

Preguntas sobre Qwen 3.8 y SillyTavern

¿Qwen3.8-27B es un modelo oficial?+

Esta guía no ha podido verificarlo como lanzamiento oficial de Qwen. El anuncio de Qwen usa Qwen3.8-Max y declara 2,4T de parámetros totales y 95B activos. Trata 27B como una etiqueta de la comunidad hasta que una página oficial de checkpoint diga lo contrario.

¿Qué ID debo introducir en SillyTavern?+

Usa el ID exacto que devuelve tu proveedor. El ejemplo oficial usa qwen3.8-max; una guía de terceros reserva qwen3.8-max-preview para un canal de prueba. No deduzcas un alias a partir de un fragmento de búsqueda.

¿Qué plantilla de chat debo usar?+

Los proveedores alojados suelen encargarse de serializar los mensajes. Los pesos locales deben usar la plantilla de su tokenizer y la documentación del checkpoint. Aplicar una plantilla en el frontend y otra en el proveedor puede romper los roles.

¿Conviene activar el razonamiento para RP?+

Empieza con low o medium para medir la latencia y después compara xhigh con la misma tarjeta. Las notas oficiales de Qwen indican low, medium y xhigh, con xhigh por defecto. Más razonamiento no garantiza una voz de personaje mejor.

¿Por qué el RP va lento o ignora las reglas?+

El hilo de Reddit contiene informes de razonamiento largo y otros de respuestas rápidas con menos obediencia al formato. Revisa por separado el proveedor, la longitud del preset, reasoning_effort y la posición de las reglas.

¿Puedo usar Qwen3.8-Max en Tabbit?+

Solo si aparece en el selector de modelos de tu Tabbit. Si está disponible, deja abierta la página o el archivo del personaje y cítalo con @. La disponibilidad cambia según edición, región, cuenta y despliegue.

Deja la fuente junto a la escena

Instala Tabbit para macOS o Windows, revisa el selector y lleva las referencias del personaje a una conversación en el navegador.

El acceso a modelos y sus condiciones dependen de la edición y del despliegue.

© 2026 Tabbit Browser. El navegador nativo de IA que entiende tu contexto.