Qwen 3.8 · SillyTavern 實用指南

在 SillyTavern 使用 Qwen 3.8

這個名稱經常被混用。Qwen 官方發布的是 Qwen3.8-Max,總參數 2.4T、啟用參數 95B。搜尋結果和社群貼文中的「Qwen3.8-27B」,本頁沒有找到相應的官方發布或 API 契約。調整預設前,先確認你的提供商實際提供哪個模型。

核對模型契約

本指南分開處理官方證據和社群體驗,不提供繞過安全限制的方法,也不承諾每個 Tabbit 帳號都有該模型。

Tabbit 新分頁開啟模型選擇器,輸入框可以引用網頁或上傳檔案

先把名稱弄準確

三個標籤,三個問題

許多設定問題在第一條訊息前就發生:搜尋摘要、本地權重和託管別名被當成同一個契約。

01

官方名稱

Qwen 2026 年 8 月 3 日的公告使用 Qwen3.8-Max,並給出總參數 2.4T、啟用參數 95B。這些數字不能證明存在 27B 版本。

02

27B 說法

社群貼文和搜尋摘要可以看到「Qwen3.8-27B」,但本頁無法把它核實為官方 Qwen 檢查點。不要只憑名稱下載檔案或選擇量化。

03

託管模型 ID

官方範例使用 qwen3.8-max。第三方路由文章還提到預覽通道 qwen3.8-max-preview。在 SillyTavern 應使用提供商列表中的精確 ID,並記錄回傳的 model。

04

本地與 API

託管端點使用提供商規定的協定和模板,本地權重使用自己的 tokenizer 與聊天模板。不要把 Qwen 模板重複套在已經格式化訊息的端點上。

SillyTavern 設定路徑

先修正契約,再調文風

角色卡和預設無法修復錯誤的端點。先從連線開始核對,再跑一輪短 RP 對照。

SillyTavern 是專門的 RP 前端。預設名稱和提供商行為來自各自作者與服務,不是 Qwen 發布說明的一部分。

  1. 1. 確認提供商

    開啟提供商目前的模型列表。如果沒有 Qwen3.8-Max,或給出的 ID 不同,就不要繼續使用猜出的 qwen3.8 別名。過濾和延遲屬於提供商現象。

  2. 2. 匹配端點

    OpenAI 相容路由使用 Chat Completions 和提供商文件規定的 model 欄位。Key 與 Base URL 放在提供商設定中,不要寫進角色卡或提示詞。

  3. 3. 讓端點負責模板

    託管路由通常會自行序列化訊息。本地權重則等檢查點文件提供模板後,再使用 tokenizer 的官方模板。模板不匹配會看起來像 RP 能力差。

  4. 4. 從低思考開始

    Qwen 官方說明列出 low、medium、xhigh,預設是 xhigh。先用 low 或 medium 建立延遲和格式遵循基線,再在同一張角色卡比較 xhigh。

短診斷

三輪找出問題在哪

固定角色卡、開場、脈絡上限和輸出上限,一次只改變一個變數。

看到的現象先檢查小修復
找不到模型或靜默回退提供商模型列表和回傳的 model ID複製準確 ID,刪除猜出的 27B 別名。
角色格式或標記異常端點模式和聊天模板歸屬只使用提供商模板,或只使用本地檢查點模板。
思考很久但劇情不動reasoning_effort、輸出上限和預設長度比較 low/medium 與 xhigh,並要求場景發生一個具體變化。
角色忽略格式規則規則長度、位置和目前分支把簡短格式契約放到末尾,再測試兩輪。
不同提供商過濾或拒答不同直連與第三方路由記錄提供商行為,不把它稱為模型事實。

RP 提示詞契約

少寫幾條,減少遺失規則

社群討論同時出現過度思考和格式遵循變弱的回饋。使用短契約,觀察後兩輪是否仍然遵循。

Role: 你是[角色]。
Scene: [地點、關係、目前衝突]。
Style: [視角、語言、句長]。
Direction: 每輪推進一個可觀察動作。不要替使用者說話或決定。
Continuity: 只使用已確認事實;不確定時提問。
Format: 先動作,再對話。250 到 450 字。不重述,不解釋規則。
Check: 保持語氣、格式、邊界和上一輪未解決的線索。

固定角色卡,先用關閉思考或 low 跑一次,再用 medium 或 xhigh 比較。記錄延遲、重複細節、規則遵循和劇情推進。

瀏覽器路徑

角色資料已在網頁上時,用 Tabbit

SillyTavern 適合角色卡和世界書。Tabbit 解決另一件事:讓設定 wiki、參考頁面或檔案和對話保持在一起。

  1. 1

    保留資料頁

    開啟角色表、世界觀 wiki 或寫作簡報。可以直接引用網頁,不必把每一段複製進提示詞。

  2. 2

    查看選擇器

    開啟 Tabbit 模型選擇器,只有當你的版本和帳號顯示 Qwen3.8-Max 時才選擇它。選擇器是 Tabbit 可用性的準确信息源。

  3. 3

    使用 @ 引用

    用 @ 把開啟的分頁、截圖或檔案帶入脈絡。可以讓模型檢查連續性、短篇重寫,或對照資料事實。

  4. 4

    保留頁面再比較

    用多模型對話請另一個模型閱讀同一份資料。截圖展示真實瀏覽器流程,不代表每個帳號都能使用相同模型。

Tabbit 模型選擇器顯示聊天模型,輸入框可以引用網頁或上傳檔案

Tabbit

使用 @ 引用

Qwen 官方:Qwen3.8-Max 發布說明

01

Qwen 官方:Qwen3.8-Max 發布說明

官方名稱、2026-08-03 日期、2.4T 總參數、95B 啟用參數和 API 思考說明。

Tabbit 模型選擇器顯示聊天模型,輸入框可以引用網頁或上傳檔案

02

保留頁面再比較

用多模型對話請另一個模型閱讀同一份資料。截圖展示真實瀏覽器流程,不代表每個帳號都能使用相同模型。

選擇前端

SillyTavern 還是 Tabbit?

選擇真正負責你工作流難點的工具。兩者都能聊天,但設定入口不同。

需求SillyTavernTabbit
角色卡和世界書專門控制項引用網頁和檔案
預設和提示詞順序細粒度控制系統提示詞和 Skills
邊查資料邊 RP擴充功能或複製貼上開啟的分頁成為脈絡
模型比較設定提供商或擴充功能瀏覽器內多模型對話
第一步核對提供商、模板和角色卡開啟資料頁,再查看選擇器

常見問題

Qwen 3.8 SillyTavern 問答

Qwen3.8-27B 是官方模型嗎?+

本指南無法核實它是官方 Qwen 發布。Qwen 公告使用 Qwen3.8-Max,並給出總參數 2.4T、啟用參數 95B。除非官方檢查點頁面明確說明,否則應把 27B 當作未核實的社群標籤。

SillyTavern 裡該填哪個模型 ID?+

使用提供商回傳的準確 ID。官方範例是 qwen3.8-max,第三方路由文章提到預覽通道 qwen3.8-max-preview。不要從搜尋摘要猜別名。

該使用哪個聊天模板?+

託管提供商通常負責訊息序列化。本地權重應使用 tokenizer 和檢查點文件中的模板。前端和提供商同時套模板會破壞角色。

RP 要不要開啟思考?+

先用 low 或 medium 建立延遲基線,再用同一張角色卡比較 xhigh。Qwen 官方列出 low、medium、xhigh,預設 xhigh。思考更多不等於角色語氣一定更好。

為什麼 RP 很慢或不遵守規則?+

Reddit 討論同時有長思考和快速但格式遵循較弱的回饋。請分別檢查提供商、預設長度、思考檔位和規則位置。

能在 Tabbit 使用 Qwen3.8-Max 嗎?+

只有當 Tabbit 模型選擇器顯示它時才可以。可用時,可以開啟角色頁面或檔案,並用 @ 引用。可用性會因版本、地區、帳號和推出進度而不同。

讓資料頁留在場景旁邊

安裝 macOS 或 Windows 版 Tabbit,查看模型選擇器,把角色資料帶入瀏覽器對話。

模型可用性和使用條件會因版本和推出進度而變化。

© 2026 Tabbit Browser. 理解你上下文的 AI 原生瀏覽器。