KIMI K3 API + SILLYTAVERN

O contrato da API Kimi K3, sem adivinhação

O SillyTavern pode acessar Kimi K3 por uma conexão compatível com OpenAI, mas o modelo mantém regras próprias. Comece pelo endpoint e alias exatos, depois confira corpo, bloco de raciocínio, provedor e código de status.

Ver contrato da API

A documentação oficial usa https://api.moonshot.ai/v1 e kimi-k3. K3 sempre pensa: use reasoning_effort em vez de copiar um bloco thinking do K2.x.

Nova aba do Tabbit com prompt central e seletor de modelos em um contexto de chat no navegador.

O QUE DIZEM AS FONTES

Compatível com OpenAI não significa os mesmos parâmetros

A documentação oficial da Kimi é precisa sobre K3. Resultados da comunidade dão pistas sobre lentidão, excesso de raciocínio, cotas ou filtros, mas não são garantias de serviço.

01

Endpoint e alias

O guia oficial usa https://api.moonshot.ai/v1 e o alias kimi-k3 no Chat Completions.

02

O raciocínio aparece na resposta

K3 mantém thinking ativo. No streaming, reasoning_content pode vir separado de content e o turno seguinte pode exigir a mensagem assistant completa.

03

O provedor importa

Um frontend compatível não torna os provedores iguais. Confira alias, limites, campos aceitos e retenção do bloco de raciocínio.

CONTRATO DA API

Quatro verificações antes de mexer no preset

Separe autenticação de parâmetros. Guarde a chave em uma variável de ambiente e comece com Chat Completions.

Corpo mínimo

curl https://api.moonshot.ai/v1/chat/completions \
+  -H "Authorization: Bearer $MOONSHOT_API_KEY" \
+  -H "Content-Type: application/json" \
+  -d '{"model":"kimi-k3","reasoning_effort":"high","messages":[{"role":"user","content":"Hello"}]}'

O código mostra os nomes oficiais. Não adicione campos fixos de K3 só porque o cliente OpenAI os aceita.

  1. 01

    1. Base URL

    Use https://api.moonshot.ai/v1 como base URL do cliente OpenAI. Um proxy pode publicar outra URL; siga a documentação dele.

  2. 02

    2. Chave Bearer

    Crie uma chave no Kimi API Platform e envie como Authorization: Bearer. Guarde em MOONSHOT_API_KEY ou na variável do provedor, nunca em um preset público.

  3. 03

    3. Alias exato

    A rota oficial usa kimi-k3. O nome visível Kimi K3 nem sempre é o slug da requisição; confirme na lista do provedor.

  4. 04

    4. Preserve o turno assistant

    Se a resposta tiver reasoning_content, preserve a mensagem assistant completa no próximo turno. Remover campos pode gerar resposta vazia ou inválida.

CAMPOS DO MODELO

K3 usa reasoning_effort, não um bloco K2.x copiado

O erro comum é tratar todos os modelos Kimi como uma API só. K3 e K2.x têm controles de raciocínio diferentes e rejeitam alguns campos.

01

Raciocínio do K3

Use reasoning_effort no nível superior com low, high ou max. O padrão oficial é max e thinking continua ativo.

02

thinking do K2.x

O objeto thinking pertence ao K2.x. Não o cole em uma requisição K3, a menos que o provedor documente uma camada de tradução.

03

Ferramentas e partial mode

K3 aceita tool_choice auto, none e required. partial mode usa uma mensagem assistant com partial=true e é separado do template de texto do SillyTavern.

No K3, omita temperature, top_p, n, presence_penalty e frequency_penalty. A referência oficial os marca como fixos. Para controles do provedor, siga a documentação dele.

VERIFICAÇÃO DO PROVEDOR

A mesma interface pode esconder contratos diferentes

Use a linha oficial ao chamar a Moonshot. Em um gateway ou endpoint compartilhado, confirme cada valor na documentação do provedor.

API oficial da MoonshotGateway ou provedor externo
Base URLhttps://api.moonshot.ai/v1Use exatamente a URL do provedor
Campo do modelokimi-k3Confirme o slug ou alias exibido
Controle de raciocínioreasoning_effort: low | high | maxConfira se o campo é repassado ou alterado
Limites e acessoNível da conta e limites atuais da KimiCobrança, cota, RPM, TPM e concorrência do provedor
HistóricoPreserve a mensagem assistant completaConfira se reasoning_content é mantido

BANCO DE ERROS

Leia o código antes de reescrever o prompt

Estas verificações indicam a próxima ação. O texto exato varia entre provedores.

401

A chave falta, está malformada, expirou ou foi enviada ao host errado.

Confira Authorization, a variável de ambiente, o provedor escolhido e o acesso da conta. Troque a chave se ela foi exposta.

404

O caminho ou alias não está disponível nesse provedor.

Confirme que a base URL termina em /v1, que o caminho é /chat/completions e que a lista contém kimi-k3 ou o alias documentado.

429

A requisição atingiu limite de taxa, concorrência, cota ou conta.

Leia os limites do provedor, reduza turnos paralelos, encurte o contexto e tente novamente com espera. Um relato não é limite universal.

400 ou vazio

Há campo não aceito, formato thinking incompatível ou turno assistant incompleto.

Remova thinking do K2.x e campos fixos do K3, valide messages e retorne reasoning_content quando necessário.

MENOS CONFIGURAÇÃO

Use Kimi ao lado da página antes de conectar uma API

Se você só quer perguntar sobre uma ficha, wiki ou brief, o Tabbit oferece chat no navegador. Ele não substitui o SillyTavern nem expõe cards ou lorebooks.

Seletor de modelos do Tabbit com várias opções e alternância multimodelo. É um exemplo de interface, não prova de disponibilidade atual de Kimi.
01

Abra o contexto

Deixe a ficha, a página de lore ou o rascunho em uma aba. O Tabbit pode referenciar a página, uma captura ou um arquivo local.

Barra lateral do Tabbit ao lado de um artigo, com resumo e campo de pergunta sobre a página visível.
02

Escolha Kimi-K3

Selecione Kimi-K3 no seletor atual do Chat ou da nova aba. As imagens são exemplos; confira a lista e o acesso no aplicativo.

Chat multimodelo do Tabbit com cinco colunas, incluindo uma coluna Kimi-K3 para comparação.
03

Pergunte e compare enquanto lê

Use a barra lateral ou compare respostas em uma vista. Você evita configurar um endpoint nesse fluxo e mantém os recursos de personagem no SillyTavern.

MANTENHA A DIFERENÇA CLARA

SillyTavern e Tabbit cuidam de camadas diferentes

Escolha a ferramenta para a próxima tarefa. Um atalho de chat não é um motor de cards.

SillyTavernTabbit
Endpoint e chaveConfigurar provedor, chave, alias e templateEscolher um modelo integrado disponível
Cards e lorebooksFluxo central do SillyTavernPágina ou arquivo como contexto
DiagnósticoInspecionar resposta e extensões do provedorPerguntar ao lado da página sem gerenciar campos da API
Extensões e gruposEcossistema SillyTavernSuperfície de produto diferente

FAQ DA API K3

Respostas para a próxima falha

Qual é o endpoint oficial do Kimi K3?+

O guia oficial usa https://api.moonshot.ai/v1 e o caminho /chat/completions. Um gateway pode publicar outra base URL.

Qual alias devo inserir no SillyTavern?+

Para a Moonshot oficial, kimi-k3. Em outro provedor, use o slug exato da lista atual.

Devo enviar thinking ou reasoning_effort?+

K3 usa reasoning_effort com low, high ou max e thinking fica sempre ativo. O objeto thinking é do K2.x.

Por que a resposta é lenta, vazia ou cheia de raciocínio?+

K3 sempre raciocina. Confira effort, streaming e a preservação da mensagem assistant completa com reasoning_content. Relatos da comunidade não são garantia.

Por que um preset OpenAI retorna 400?+

Remova campos fixos como temperature e a configuração thinking do K2.x. Depois valide alias, messages e o schema do provedor.

Posso testar Kimi K3 sem uma API key?+

O seletor atual do Tabbit mostra Kimi-K3, então você pode testar a rota no navegador sem criar seu endpoint primeiro. O acesso e as cotas podem mudar.

Deixe a profundidade dos personagens no SillyTavern. Use o Tabbit para perguntas rápidas.

Para cards, lorebooks e extensões, configure o SillyTavern. Para perguntar agora sobre uma página, abra o Tabbit e escolha o modelo no seletor atual.

Disponível para macOS e Windows. O acesso ao modelo depende da edição e do plano.

© 2026 Tabbit Browser. O navegador nativo de IA que entende o seu contexto.