
ミステリー
口調を保てるか
人物説明を繰り返すのではなく、設定した話し方に沿っているか。
SillyTavernのモデル選び
すべてのキャラクターカードに合う万能なモデルはありません。最近の利用傾向を参考にしつつ、実際に使える接続先で同じカードと場面を比較しましょう。
現在の候補を見る人気は特定ネットワークでの利用を示す指標です。ロールプレイ品質の統制テストでも、SillyTavern互換性の保証でもありません。

日付付き利用状況
確認日:2026年9月23日
同ページは、過去7日間にOpenRouterで処理された入力・出力トークンをもとに並べています。ネットワーク全体の利用量であり、SillyTavernだけの利用や文章品質を測るものではありません。
| 順位 | モデル | コレクション内の利用割合 |
|---|---|---|
| 01 | GLM 5.3 Flash | 16.7%今回のスナップショットで最多。利用傾向のみを示す。 |
| 02 | DeepSeek V4.1 Flash | 8.0%確認時点でコレクション内の利用量2位。 |
| 03 | Tencent Hy4 preview | 6.5%3位。プレビュー版のため利用可否に注意。 |
| 04 | GPT-5.6 Luna | 6.2%4位。接続先やアカウント権限で異なる。 |
| 05 | DeepSeek V4 Flash 0731 | 6.0%5位。バックエンドの正確なモデルIDを確認。 |
日付付きのスナップショットで、順位は変わります。modelgrepのページは異なるOpenRouterロールプレイ比率の条件を使うため、順位も異なります。どちらもSillyTavern専用テストではありません。
カードに合わせて選ぶ
各モデルでカード、冒頭文、コンテキスト上限、生成設定、回答量を揃えます。目に見える変化を記録し、印象的な一段落だけで判断しないようにします。

ミステリー
人物説明を繰り返すのではなく、設定した話し方に沿っているか。

修理シーン
変化や次の選択が生まれるか。同じ描写を繰り返していないか。

会話シーン
次のターンで、直前の選択とその結果が反映されるか。
これは評価のための問いで、ベンチマーク結果ではありません。複数ターン試し、遅延、料金、提供元の制限は別に記録してください。
任意の比較方法
複数モデルの返答を並べると、口調を見比べやすくなります。Tabbitは利用可能なモデルを一画面で比較できますが、使えるモデルは提供元、モデルID、アカウント権限によります。TabbitはSillyTavernとは別の製品です。


画像はTabbit Browserの画面です。SillyTavernや記事内の測定結果ではありません。
よくある質問
カードや接続先によって異なります。日付付きの一覧を候補として、利用可能な接続先で同じ場面を比較してください。
含まれません。推論バックエンドに接続するフロントエンドです。利用権限、上限、料金、データ処理、モデレーションは提供元やローカルサーバーによります。
必ずしもそうではありません。引用したランキングは提供ネットワークでの利用状況で、SillyTavernユーザーだけの集計や統制条件での一貫性テストではありません。