語氣漂移
模型記得事實,卻開始使用泛化敘事、換視角,或讓所有角色說話一樣。把文風和說話規則寫成一段短指令。
QWEN3.8-27B 角色扮演指南
Qwen3.8-27B 能記住小細節,也能緊跟角色卡,但預設文風可能偏平,思考模式還可能吃掉整輪劇情。本指南提供測試角色語氣、連貫性、重複、上下文、視覺輸入和延遲的方法。
官方模型卡和社群回饋分開標示。Tabbit 的模型可用性會隨版本、地區、帳號和發布進度變化。

RP 使用者真正會遇到的問題
有用的角色扮演測試要看場景如何推進,而不只是看基準分數。修改預設前,先把下面這些故障分開。
模型記得事實,卻開始使用泛化敘事、換視角,或讓所有角色說話一樣。把文風和說話規則寫成一段短指令。
思考預設開啟。高推理檔位可能花很久規劃簡單回覆,最後留給劇情推進的空間反而變少。
多輪之後容易出現重複動作、重述段落和熟悉句式。記錄重複動作和短語,不要只憑一條漂亮回覆判斷。
長上下文和更大的量化檔案可能讓本地執行轉向 RAM offload。更多歷史有助於保留設定,卻可能讓每輪慢到難以使用。
可重現 RP 檢查
使用相同角色卡、開場訊息、上下文視窗和輸出上限。先比較 low、medium、xhigh,再改採樣。每次記錄 model ID 和路由。

寫出角色語氣、視角、邊界、目前衝突和一個未解決線索。不同測試之間不要新增世界書條目。
如果執行環境提供該選項,比較 low、medium、xhigh。記錄首 token 延遲、總耗時、思考 token 和劇情是否推進。
標記語氣漂移、角色混淆、重複短語、重述、漏掉事實和替使用者說話。寫短記錄,不要只給模糊星級。
一次只改一個採樣值或一種量化。更換提供商、模板或上下文長度都屬於新的實驗。
Role: 你是[角色]。 Scene: [地點、關係、目前衝突]。 Voice: [視角、用詞、句子節奏]。 Direction: 推進一個可觀察動作。不要替使用者說話。 Continuity: 使用已確認事實和未解決線索。 Format: 先動作,再對話。180 到 320 字。不重述。 Check: 保持語氣,讓使用者決定下一步。
使用同一張測試卡三次,比較延遲、劇情推進、語氣、重複和格式遵循,再判斷問題來自模型、路由還是預設。
會改變體驗的設定
官方模型卡提供起點。你的後端可能使用不同名稱或限制,因此把它們當成基線,不要當成所有執行環境的承諾。
思考預設開啟。快速對話可先用 low 或 medium,遇到連貫性難題再用 xhigh。保留歷史思考有助於多輪一致,但會增加歷史和 token。
官方 instruct 基線是 temperature 0.7、top_p 0.80、top_k 20、presence_penalty 1.5。懲罰可能減少迴圈,數值過高也可能造成混語或品質下降。
模型卡建議思考模式使用 temperature 1.0、top_p 0.95、top_k 20、presence_penalty 0.0。給足輸出上限,再記錄深度帶來的成本。
託管路由通常負責序列化,本地 tokenizer 會提供模板。兩邊都套可能洩露標籤、錯置角色,或讓回覆異常短。
Qwen3.8-27B 支援圖片和影片,但只有當視覺資訊改變場景或補充文字沒有的事實時才值得加入。先跑純文字基線,再比較上下文成本。
Q3、Q4、Q5、FP8 等都是不同產物。記錄顯存、記憶體、上下文長度和 tokens/s。如果 offload 後速度驟降,先降低上下文,不要先重寫角色卡。
TABBIT 瀏覽器工作區
SillyTavern 適合角色卡和世界書。Tabbit 處理周邊資料:把官方模型卡、提供商說明、角色 wiki 和比較結果放在同一工作區,用 @ 引用,減少複製貼上。
把 Hugging Face 和後端文件留在分頁中,讓模型提取模板、思考和採樣要求。
只有當 Tabbit 選擇器出現準確的 Qwen3.8-27B 時才選擇它。目前目錄裡的 Qwen3.8 Max 是另一個家族成員。
在問題中引用模型卡、截圖、本地檔案或角色 wiki。可以讓第二個模型找出一個設定差異,再回到來源核對。
多模型對話可並排放置回答。用同一份任務說明比較語氣、連貫性和劇情推進。截圖只展示工作流,不保證模型可用。


選擇合適的工作面
兩者的重疊比搜尋結果看起來少。細粒度角色卡和世界書繼續放在專用工具裡,資料和模型比較成為瓶頸時使用瀏覽器。
| 需求 | SillyTavern | Tabbit |
|---|---|---|
| 角色卡和世界書 | 專用 RP 控件 | 引用網頁和檔案 |
| 預設和提示詞順序 | 詳細提示詞堆疊 | 短的來源約束提示詞 |
| 模型卡和提供商說明 | 複製或擴充功能 | 分頁加 @ 上下文 |
| 比較多個回答 | 提供商設定或擴充功能 | 瀏覽器內多模型對話 |
| 第一步排錯 | 核對路由和模板 | 開啟來源,再看即時可用性 |
常見問題
社群回饋並不統一。使用者常提到它遵循指令、保持連貫性的能力,也有人認為原生文風偏平或重複。固定同一張角色卡和設定後再下結論。
官方卡預設開啟 thinking,預設 reasoning effort 是 xhigh。比較 low 或 medium、輸出上限和上下文大小。單輪更快不一定代表總耗時更短,因為失敗重試會增加成本。
先檢查重述指令、輸出長度、上下文和採樣預設值。官方非思考基線使用 presence_penalty 1.5。一次改一個值,用相同對話比較。
不需要。模型支援圖片和影片,但視覺輸入應該補充文字無法提供的事實。先跑純文字基線,才能看出圖片是幫助還是只增加上下文。
使用你的路由負責的模板。託管提供商通常負責序列化,本地服務應遵循 tokenizer 文件。不要重複套用兩套模板。
只有當 Tabbit 即時模型選擇器出現準確的模型時才選擇它。可用性會隨版本、地區、帳號和發布進度變化。目錄裡的 Qwen3.8 Max 不能證明 27B 檢查點可用。
安裝 macOS 或 Windows 版 Tabbit,保留模型卡和角色資料,針對選擇器中實際可用的模型比較同一份角色扮演說明。
模型可用性和提供商設定可能變化。