Nombre oficial
El anuncio de Qwen del 3 de agosto de 2026 llama al modelo Qwen3.8-Max. Indica 2,4 billones de parámetros totales y 95 mil millones activos. Esas cifras no prueban que exista un modelo de 27B.
Qwen 3.8 · guía práctica para SillyTavern
El nombre se usa para cosas distintas. El lanzamiento oficial de Qwen es Qwen3.8-Max, con 2,4 billones de parámetros totales y 95 mil millones activos. "Qwen3.8-27B" aparece en resultados de la comunidad, pero aquí no encontramos un lanzamiento oficial ni un contrato de API de Qwen para esa etiqueta. Comprueba qué modelo expone realmente tu proveedor antes de ajustar un preset.
Esta guía separa los datos oficiales de los informes de la comunidad. No explica cómo saltarse medidas de seguridad ni promete el modelo en todas las cuentas de Tabbit.

Primero, usa el nombre correcto
Muchos fallos aparecen antes del primer mensaje: un fragmento de búsqueda, un checkpoint local y un alias alojado se tratan como si fueran el mismo contrato.
El anuncio de Qwen del 3 de agosto de 2026 llama al modelo Qwen3.8-Max. Indica 2,4 billones de parámetros totales y 95 mil millones activos. Esas cifras no prueban que exista un modelo de 27B.
La etiqueta "Qwen3.8-27B" aparece en publicaciones de la comunidad y fragmentos de búsqueda, pero aquí no se ha verificado como checkpoint oficial de Qwen. No descargues un archivo ni elijas una cuantización basándote solo en el nombre.
El ejemplo oficial usa qwen3.8-max. Una guía de terceros también menciona qwen3.8-max-preview para un canal de prueba. En SillyTavern, usa el ID exacto de tu proveedor y anota el model que devuelve.
Un endpoint alojado usa el protocolo y la plantilla de su proveedor. Un checkpoint local usa su propio tokenizer y su propia plantilla de chat. No pegues una plantilla de Qwen en un endpoint que ya serializa los mensajes.
Ruta de configuración de SillyTavern
Las tarjetas de personaje y los presets no arreglan un endpoint equivocado. Revisa primero la conexión y después haz una comparación breve de RP.
SillyTavern es un frontend especializado en RP. Los nombres de los presets y el comportamiento del proveedor pertenecen a sus autores y servicios, no a la nota de lanzamiento de Qwen.
Abre la lista actual de modelos del proveedor. Si no incluye Qwen3.8-Max o muestra otro ID, deja de usar un alias qwen3.8 inventado. Los filtros y la latencia son observaciones del proveedor.
Para una ruta compatible con OpenAI, usa Chat Completions y el campo model que documenta el proveedor. Guarda la clave y la Base URL en los ajustes del proveedor, no en la tarjeta ni en el prompt.
Las rutas alojadas suelen serializar los mensajes. Con pesos locales, usa la plantilla oficial del tokenizer cuando la documentación del checkpoint la indique. Una plantilla incorrecta puede parecer un problema de roleplay.
Las notas oficiales de Qwen indican low, medium y xhigh, con xhigh como valor predeterminado. Empieza con low o medium para medir latencia y formato; después compara xhigh con la misma tarjeta.
Diagnóstico breve
Mantén fija la tarjeta, el mensaje inicial, el límite de contexto y el máximo de salida. Cambia una sola variable cada vez.
| Lo que ves | Comprueba primero | Ajuste pequeño |
|---|---|---|
| Modelo no encontrado o fallback silencioso | Lista del proveedor y model devuelto | Copia el ID expuesto y elimina los alias 27B inventados. |
| El marcado o el rol se ve roto | Modo del endpoint y dueño de la plantilla | Usa la plantilla del proveedor o la del checkpoint local, nunca las dos. |
| Mucho razonamiento y poco avance | reasoning_effort, límite de salida y longitud del preset | Compara low/medium con xhigh y pide un cambio concreto en la escena. |
| El personaje ignora las reglas de formato | Longitud, posición y rama activa de las reglas | Pon un contrato de formato corto al final y prueba dos turnos más. |
| El filtro o el rechazo cambia según el proveedor | Ruta directa frente a ruta de terceros | Registra el comportamiento del proveedor; no lo presentes como un hecho del modelo. |
Contrato del prompt de RP
El hilo de la comunidad recoge tanto exceso de razonamiento como menor obediencia al formato. Usa un contrato corto y observa los dos turnos siguientes.
Rol: Eres [personaje]. Escena: [lugar, relación, conflicto actual]. Estilo: [punto de vista, idioma, longitud de frase]. Dirección: Avanza una acción observable por turno. No hables ni decidas por el usuario. Continuidad: Usa solo hechos confirmados; pregunta si hay duda. Formato: Primero la acción y después el diálogo. De 250 a 450 palabras. Sin resumen ni explicación de reglas. Comprobación: Conserva la voz, el formato, los límites y la pista pendiente del turno anterior.
Para comparar, usa la misma tarjeta una vez con el razonamiento desactivado o en low, y otra con medium o xhigh. Guarda la latencia, los detalles repetidos, el cumplimiento y el avance de la escena.
Ruta en el navegador
SillyTavern funciona bien con tarjetas y libros de lore. Tabbit resuelve otra parte: mantener una wiki, una página de referencia o un archivo junto a la conversación.
Abre la ficha del personaje, la wiki del mundo o el brief de escritura en una pestaña. Puedes citarla sin pegar cada párrafo en el prompt.
Abre el selector de modelos de Tabbit y elige Qwen3.8-Max solo si aparece en tu edición y cuenta. Ese selector indica qué modelos tiene disponibles Tabbit.
Usa @ para llevar una pestaña, captura o archivo abierto al contexto. Pide una revisión de continuidad, una reescritura breve o una comparación con los hechos de la fuente.
Usa el chat multimodelo para pedir una segunda lectura del mismo material. La captura muestra un flujo real del navegador, no garantiza el mismo acceso a modelos.

Tabbit

01
Nombre oficial, fecha del 3 de agosto de 2026, cifras de 2,4T y 95B, y notas de razonamiento en la API.

02
Usa el chat multimodelo para pedir una segunda lectura del mismo material. La captura muestra un flujo real del navegador, no garantiza el mismo acceso a modelos.
Elige el frontend
Elige la herramienta que controla la parte difícil de tu flujo. Ambos permiten chatear, pero sus ajustes no son iguales.
| Necesidad | SillyTavern | Tabbit |
|---|---|---|
| Tarjetas y libros de lore | Controles dedicados | Citar páginas y archivos |
| Presets y orden del prompt | Control detallado | Prompt del sistema y Skills |
| Investigar junto al RP | Extensiones o copiar y pegar | Las pestañas abiertas son contexto |
| Comparar modelos | Ajustes del proveedor o extensiones | Chat multimodelo en el navegador |
| Primer paso | Verificar proveedor, plantilla y tarjeta | Abrir la fuente y revisar el selector |
Consulta las fuentes
La página separa los hechos del modelo de la experiencia de la comunidad. Lee las páginas originales antes de cambiar un preset que ya funciona.
Preguntas frecuentes
Esta guía no ha podido verificarlo como lanzamiento oficial de Qwen. El anuncio de Qwen usa Qwen3.8-Max y declara 2,4T de parámetros totales y 95B activos. Trata 27B como una etiqueta de la comunidad hasta que una página oficial de checkpoint diga lo contrario.
Usa el ID exacto que devuelve tu proveedor. El ejemplo oficial usa qwen3.8-max; una guía de terceros reserva qwen3.8-max-preview para un canal de prueba. No deduzcas un alias a partir de un fragmento de búsqueda.
Los proveedores alojados suelen encargarse de serializar los mensajes. Los pesos locales deben usar la plantilla de su tokenizer y la documentación del checkpoint. Aplicar una plantilla en el frontend y otra en el proveedor puede romper los roles.
Empieza con low o medium para medir la latencia y después compara xhigh con la misma tarjeta. Las notas oficiales de Qwen indican low, medium y xhigh, con xhigh por defecto. Más razonamiento no garantiza una voz de personaje mejor.
El hilo de Reddit contiene informes de razonamiento largo y otros de respuestas rápidas con menos obediencia al formato. Revisa por separado el proveedor, la longitud del preset, reasoning_effort y la posición de las reglas.
Solo si aparece en el selector de modelos de tu Tabbit. Si está disponible, deja abierta la página o el archivo del personaje y cítalo con @. La disponibilidad cambia según edición, región, cuenta y despliegue.
Instala Tabbit para macOS o Windows, revisa el selector y lleva las referencias del personaje a una conversación en el navegador.
El acceso a modelos y sus condiciones dependen de la edición y del despliegue.