Qwen3.8-27B · SillyTavern実用ガイド

SillyTavernでQwen3.8-27Bを使う

この名前は実在しますが、別のモデルと混同されがちです。QwenはQwen3.8-27Bという公式のdense視覚言語チェックポイントを公開しています。Qwen3.8-Maxは別のモデルで、総パラメータ2.4T、active 95Bです。まず実際のチェックポイントとプロバイダーを確認しましょう。

モデルの身元を確認

上流の仕様とコミュニティ報告を分けて説明します。特定のプロバイダー、量子化、Tabbitアカウントでの利用を保証するものではありません。

モデル選択と@参照欄を表示したTabbitの新しいタブ

名前を確認

27Bは2.4Tモデルではない

検索結果では複数のラベルが並びますが、指している成果物は別です。名前だけをコピーすると、ローカル設定を誤った経路に導きます。

01

公式denseチェックポイント

QwenのモデルカードはQwen/Qwen3.8-27Bです。27Bパラメータ、ビジョンエンコーダー、Apache-2.0、ネイティブ262,144トークンを記載しています。

02

Qwen3.8-Maxファミリー

Qwenの発表とオープンウェイトの名前では、Qwen3.8-Maxは総2.4T、active 95Bです。オープンウェイトはQwen3.8-2.4T-A95Bで、27Bの別名ではありません。

03

コミュニティのファイル

GGUF、FP8、GPTQ、RP向けfine-tuneには作者名や接尾辞が付きます。各リポジトリを別の成果物として扱い、形式とテンプレートを確認してください。

04

ホスト型ID

SillyTavernにはプロバイダーが公開する正確なモデルIDが必要です。表示名だけではQwen3.8-27Bとは確認できません。

モデルカード

公式27Bページに書かれていること

ここでは実行環境を選ぶための上流情報を整理します。量子化ファイルごとのメモリ使用量を示すものではありません。

27Bパラメータ

dense言語モデルは27Bパラメータです。safetensorsのサイズ表示には28Bというラベルもあるため、ダウンロード表示を別モデル名にしないでください。

画像と動画

image-text-to-textとして掲載され、画像と動画の理解を説明しています。バックエンドには対応するプロセッサとマルチモーダル機能が必要です。

262Kコンテキスト

ネイティブは262,144トークンで、カードでは1Mまでの拡張も説明されています。長いコンテキストをどのGPUでも読み込めるという意味ではありません。

サービング

Transformers、vLLM、SGLang、TokenSpeed、Dockerの例があります。このアーキテクチャを明記した現行版を選びましょう。

モデル文書を確認するGoogle検索と実行手順を表示したTabbit Deep Research

SillyTavernの設定

エンドポイントから内側へ確認する

キャラクターカードでは、誤った経路や二重のテンプレートは直せません。ホスト型APIでもローカルでも、この順番で確認します。

プロバイダー名、コミュニティのプリセット、量子化リポジトリは上流モデルカードの一部ではありません。主張と出典を離さないでください。

  1. 1. 成果物の名前を確定

    リポジトリ名またはプロバイダーのIDをそのままコピーします。Qwen/Qwen3.8-27B、量子化派生物、Qwen3.8-2.4T-A95Bのどれかを区別してください。

  2. 2. バックエンドを確認

    Transformers、vLLM、SGLang、llama.cpp、使用アプリがチェックポイントと画像経路をサポートするか確認します。GGUFでは機能が限定される場合があります。

  3. 3. SillyTavernを接続

    OpenAI互換サーバーならChat Completionsを選び、文書のBase URLとサーバーが返すmodel IDを入力します。キーはカードに書きません。

  4. 4. テンプレートは一か所

    ホスト型なら経路に任せ、ローカルならtokenizerの文書を使います。二重適用するとロール崩れやタグの露出が起きます。

  5. 5. 思考設定を比較

    プロバイダーが提供するなら同じカードで無効またはlow、medium、xhighを比較します。文章プリセットを変える前に遅延を記録してください。

短い診断

まず普通の失敗を直す

カードと最初のメッセージを固定し、一度に一つだけ変えます。各応答のmodel IDをテスト記録に残します。

症状最初に確認小さな修正
モデルが見つからない、静かにfallbackするプロバイダーの一覧と応答のmodel公開されているIDをコピーし、推測した別名を削除する。
ロールやタグ、形式が崩れるテンプレートの担当箇所テンプレートを一つにして、新しいチャットで試す。
VRAMが足りない形式、コンテキスト、画像入力小さい量子化、短いコンテキスト、テキストのみで基準を作る。
思考は長いのに場面が進まない思考モード、出力上限、プリセット同じカードでlowまたはmediumとxhighを比べる。
プロバイダーごとに文体が違うフィルター、sampler、システムプロンプト経路を変数として記録し、モデルの事実とは呼ばない。

RPテストカード

短い契約だけを渡す

トラブル対処では短いテストプロンプトを使うと、テンプレート、思考、プロバイダーの差が見えます。

Role: あなたは[キャラクター]です。
Scene: [場所、関係、現在の対立]。
Style: [視点、言語、文の長さ]。
Direction: 観察できる行動を一つ進める。ユーザーの発言を代行しない。
Continuity: 確認済みの事実だけを使い、不明なら尋ねる。
Format: 行動、次に会話。250から450語。要約しない。
Check: 前のターンの声、境界、未解決の手がかりを保つ。

同じカードを3回送ります。遅延、不要なタグ、形式、場面の変化を比べてから温度やプリセットを変更します。

ブラウザ経路

モデル文書と設定資料を同じ場所に置く

カードとlorebookはSillyTavernが得意です。Tabbitは、モデルカードを読み、プロバイダーを比べ、資料を見ながら書くときのコピー作業を減らします。

  1. 1

    資料を開く

    Hugging Faceのカード、プロバイダー文書、キャラクターwikiをタブに残します。

  2. 2

    実際の選択欄を見る

    Tabbitのモデル選択を開き、エディションとアカウントに正確なQwen3.8-27Bが表示された場合だけ選びます。

  3. 3

    @で参照

    @でページ、スクリーンショット、ファイルを質問に含めます。テンプレート条件や量子化の注意書きを別モデルにも確認できます。

  4. 4

    回答を比較

    マルチモデルチャットで同じ資料を別の角度から読ませます。画像はブラウザの流れを示すもので、全員のモデル利用を約束しません。

参照記事とAIメモを同時に表示するTabbitのページ要約サイドバー

ブラウザ経路

回答を比較

参照記事とAIメモを同時に表示するTabbitのページ要約サイドバーモデル文書を確認するGoogle検索と実行手順を表示したTabbit Deep Research

使う画面を選ぶ

SillyTavernとTabbitの違い

RPの別々の部分を担当します。細かな制御は専用ツールに任せ、資料がボトルネックならブラウザを使います。

目的SillyTavernTabbit
カードとlorebookRP専用コントロールページとファイルを参照
プリセットと順序細かなプロンプト管理システムプロンプトとSkills
資料を読みながらRP拡張またはコピー開いたタブをコンテキストにする
回答の比較プロバイダーや拡張ブラウザのマルチモデルチャット
最初の一手ID、バックエンド、テンプレート確認資料を開いて選択欄を見る

よくある質問

Qwen3.8-27BとSillyTavern

Qwen3.8-27Bは公式モデルですか?+

はい。Qwen/Qwen3.8-27Bには公式Hugging Faceモデルカードがあり、27Bのdense視覚言語チェックポイントです。Qwen3.8-MaxやQwen3.8-2.4T-A95Bとは別です。

27BはQwen3.8-Maxと同じですか?+

違います。Qwen3.8-Maxは総2.4T、active 95Bと説明されています。27Bを試すときにMaxのIDや2.4T量子化を使わないでください。

どの量子化を選べばよいですか?+

GPU、RAM、コンテキスト、バックエンドで変わります。形式とloader対応を明記したリポジトリから始め、GGUF、FP8、GPTQ、fine-tuneを別成果物として扱います。

SillyTavernのチャットテンプレートは?+

ホスト型プロバイダーは通常メッセージを整形します。ローカルサーバーはtokenizerまたはチェックポイントの文書に従います。二重に適用しないでください。

RPが遅い、短いのはなぜですか?+

思考、出力上限、コンテキスト、sampler、経路を分けて確認します。同じカードで経路を記録してからプロンプトを変更してください。

TabbitでQwen3.8-27Bを実行できますか?+

Tabbitの選択欄に正確なモデルが表示された場合だけ選べます。利用状況はエディション、地域、アカウント、展開状況で変わります。

資料を開いたままにする

macOSまたはWindows版Tabbitを入手し、モデル選択を確認して、モデルカードやキャラクターwikiを同じブラウザ会話に持ち込みます。

モデル利用とプロバイダー条件はエディションと展開状況で変わります。

© 2026 Tabbit Browser. あなたのコンテキストを理解する AI ネイティブブラウザ。