KIMI K3 API + SILLYTAVERN

Kimi K3 API の契約を確認してから設定する

SillyTavern は OpenAI 互換接続で Kimi K3 に接続できます。ただしモデル固有のルールがあります。正確な endpoint と別名から始め、リクエスト本文、推論ブロック、provider、ステータスコードの順に確認します。

API の契約を見る

公式ドキュメントは https://api.moonshot.ai/v1 と kimi-k3 を使います。K3 は常に thinking が有効なので、K2.x の thinking 設定ではなく reasoning_effort を使います。

中央にプロンプトとモデル picker がある Tabbit デスクトップの新規タブ画面。ブラウザでのチャット利用例。

公式情報を確認

OpenAI 互換でもパラメータが同じとは限らない

Kimi の公式ドキュメントは K3 のルールを明確に示しています。コミュニティの検索結果は遅さ、過剰な推論、クォータ、フィルター表示を調べる手がかりですが、サービス保証ではありません。

01

Endpoint と別名

公式クイックスタートは Moonshot API の https://api.moonshot.ai/v1 と、Chat Completions のモデル別名 kimi-k3 を使います。

02

推論もレスポンスの一部

K3 は常に thinking が有効です。ストリーミングでは reasoning_content が content と分かれて届くことがあり、複数ターンでは assistant メッセージ全体の保持が必要になる場合があります。

03

Provider ごとに挙動が違う

互換フロントエンドでも provider の契約は同じになりません。モデル一覧、別名、制限、対応フィールド、返された推論ブロックの保持を確認してください。

API の契約

preset を編集する前の四つの確認

認証の問題とモデルパラメータの問題を切り分けます。キーは環境変数に保存し、まず Chat Completions から始めます。

最小リクエスト

curl https://api.moonshot.ai/v1/chat/completions \
+  -H "Authorization: Bearer $MOONSHOT_API_KEY" \
+  -H "Content-Type: application/json" \
+  -d '{"model":"kimi-k3","reasoning_effort":"high","messages":[{"role":"user","content":"Hello"}]}'

コードは公式のフィールド名を示しています。OpenAI クライアントが受け付けるからといって、K3 の固定フィールドを追加しないでください。

  1. 01

    1. Base URL

    OpenAI クライアントの base URL に https://api.moonshot.ai/v1 を指定します。provider の proxy は別 URL の場合があるため、その文書を使います。

  2. 02

    2. Bearer キー

    Kimi API Platform でキーを作成し、Authorization: Bearer として送ります。MOONSHOT_API_KEY などの変数に保存し、公開 preset に実際のキーを貼らないでください。

  3. 03

    3. 正確なモデル別名

    公式 K3 API では kimi-k3 を使います。表示名 Kimi K3 がリクエスト用 slug とは限りません。provider の一覧を確認します。

  4. 04

    4. assistant ターンを保持

    レスポンスに reasoning_content が含まれる場合、次のターンでは assistant メッセージ全体を保持します。thinking のフィールドを削ると空または無効な応答になることがあります。

モデル固有フィールド

K3 は reasoning_effort を使う。K2.x の設定をコピーしない

よくある不一致は、すべての Kimi モデルを同じ API と考えることです。K3 と K2.x は推論制御が異なり、見慣れたフィールドを拒否することがあります。

01

K3 の推論

トップレベルの reasoning_effort に low、high、max を指定します。公式のデフォルトは max で、thinking は有効なままです。

02

K2.x の thinking

thinking オブジェクトは K2.x の例に属します。provider が変換層を明記していない限り、thinking: { type: enabled } を K3 に貼り付けないでください。

03

ツールと partial mode

K3 の tool_choice は auto、none、required に対応します。partial mode は partial=true の assistant メッセージを使い、SillyTavern のテキストテンプレートとは別です。

K3 では temperature、top_p、n、presence_penalty、frequency_penalty を省略します。公式リファレンスでは固定値です。provider 独自の設定はその文書に従います。

Provider を確認

同じ画面でも契約は異なる

Moonshot を直接呼ぶ場合は公式の行を使います。gateway や共有 endpoint では、文書で確認するまで各値を provider 固有として扱います。

Moonshot 公式 APIGateway / 外部 provider
Base URLhttps://api.moonshot.ai/v1provider の URL をそのまま使う
モデルフィールドkimi-k3表示された slug または別名を確認
推論制御reasoning_effort: low | high | maxフィールドが透過されるか変換されるか確認
制限とアクセスKimi アカウントのランクと現在の制限provider の課金、クォータ、RPM、TPM、同時実行数
履歴assistant メッセージ全体を保持reasoning_content が保持されるか確認

エラー確認

prompt を書き直す前にステータスコードを読む

次に行う確認をコードごとにまとめています。provider ごとにエラー文が同じとは限りません。

401

キーがない、形式が違う、期限切れ、または別のホストに送られています。

Authorization ヘッダー、環境変数、選択した provider、アカウント権限を確認します。漏えいしたキーは交換してください。

404

この provider では URL パスまたはモデル別名が利用できません。

base URL が /v1 で終わり、パスが /chat/completions であること、モデル一覧に kimi-k3 または文書化された別名があることを確認します。

429

レート、同時実行、クォータ、アカウントの制限に達しました。

provider の制限を読み、並列ターンを減らし、コンテキストを短くしてバックオフ付きで再試行します。コミュニティの報告を共通制限と考えないでください。

400 または空

未対応フィールド、thinking 形式の不一致、assistant ターンの欠落があります。

K2.x の thinking と K3 の固定パラメータを削除し、messages を検証します。必要なら reasoning_content を含む assistant メッセージを返します。

設定を減らす方法

API をつなぐ前にページの横で Kimi を使う

キャラクターシート、wiki、文章メモについて質問したいだけなら、Tabbit のブラウザチャットを使えます。SillyTavern の代わりではなく、ST のカードや lorebook は提供しません。

複数のモデルとマルチモデル切替を表示した Tabbit の新規タブモデル picker。画面例であり、現在の Kimi の利用可能性を示すものではありません。
01

今ある文脈を開く

キャラクターシート、lore ページ、下書きをタブに残します。Tabbit の入力では表示中のページ、スクリーンショット、ローカルファイルを参照できます。

記事の横に表示された Tabbit のサイドバー。要約パネルと表示ページについて質問する入力欄があります。
02

現在の picker で Kimi-K3 を選ぶ

Chat または新規タブのモデル picker から Kimi-K3 を選択します。画像は画面例なので、インストール後に現在の一覧と利用条件を確認してください。

五つの返答列がある Tabbit のマルチモデルチャット。比較用に Kimi-K3 の列が表示されています。
03

読みながら質問と比較

サイドバーで質問するか、一つの画面で複数モデルの返答を比べます。このブラウザの流れでは endpoint の設定を省けますが、キャラクター機能は SillyTavern に残します。

役割を分ける

SillyTavern と Tabbit は別の層を扱う

次の作業に合うツールを選びます。ブラウザチャットの近道はキャラクターカードエンジンではありません。

SillyTavernTabbit
API endpoint とキーprovider、キー、別名、テンプレートを設定利用できる内蔵モデルを選ぶ
キャラクターカードと lorebookSillyTavern の中心機能ページやファイルを文脈にする
推論の診断provider のレスポンスと拡張を確認API フィールドを管理せずページの横で質問
拡張とグループチャットSillyTavern のエコシステム異なる製品領域

K3 API よくある質問

次の失敗したターンで確認すること

Kimi K3 の公式 endpoint は?+

公式ガイドは https://api.moonshot.ai/v1 と /chat/completions を使います。gateway では別の base URL の場合があります。

SillyTavern に入力するモデル別名は?+

公式 Moonshot API では kimi-k3 です。別 provider では現在の一覧にある正確な slug を使います。

thinking と reasoning_effort のどちらを送る?+

K3 は reasoning_effort に low、high、max を指定し、thinking は常に有効です。thinking オブジェクトは K2.x 用です。

応答が遅い、空、推論が長いのはなぜ?+

K3 は常に推論します。effort、streaming、次のリクエストで assistant メッセージ全体と reasoning_content を保持しているか確認します。コミュニティの速度報告はサービス保証ではありません。

OpenAI の preset をコピーすると 400 になるのはなぜ?+

temperature などの固定フィールドと K2.x の thinking を削除し、別名、messages、provider のスキーマを確認します。

API キーなしで Kimi K3 を試せる?+

現在の Tabbit picker に Kimi-K3 が表示されるため、endpoint を作らずブラウザ経路を試せます。アクセスとクォータは変わる可能性があります。

キャラクターの深さは SillyTavern に。ページへの質問は Tabbit に。

カード、lorebook、拡張が必要なら SillyTavern を設定します。ページについて今すぐ Kimi に聞くなら Tabbit を開き、現在の picker からモデルを選びます。

macOS と Windows に対応しています。モデルへのアクセスは現在のエディションとプランによって異なります。

© 2026 Tabbit Browser. あなたのコンテキストを理解する AI ネイティブブラウザ。