ID estável
Use `gemini-2.5-flash-lite`. O Google marca `gemini-2.5-flash-lite-preview-09-2025` como encerrado. Alterar a temperatura não corrige um ID retirado.
GEMINI API × SILLYTAVERN
Use o modelo estável Gemini 2.5 Flash-Lite no SillyTavern pelo Google AI Studio. Confira o provider, a chave, o ID exato, o primeiro pedido, thinking e os erros que fazem uma conexão válida parecer quebrada.

CONFIRA O MODELO
O Google descreve o Gemini 2.5 Flash-Lite como um modelo multimodal estável e rápido. Ele aceita texto, imagens, vídeo, áudio e PDF, e retorna texto. Uma janela de contexto grande não elimina as cotas do projeto nem as verificações do provider.
Use `gemini-2.5-flash-lite`. O Google marca `gemini-2.5-flash-lite-preview-09-2025` como encerrado. Alterar a temperatura não corrige um ID retirado.
A página do modelo lista 1.048.576 tokens de entrada e 65.536 de saída. Seus limites reais de RPM, TPM e RPD dependem do projeto e do nível de uso.
O Google lista thinking, chamadas de função, saída estruturada, URL context, Search grounding, execução de código, cache e busca de arquivos. O SillyTavern pode mostrar menos controles.
O acesso gratuito e o pago têm limites diferentes. Consulte uso e preços no AI Studio antes de uma sessão longa de RP. Grátis não significa ilimitado.

CONFIGURAÇÃO DO SILLYTAVERN
O guia oficial do SillyTavern coloca o Google AI Studio em Chat Completion. Mantenha o primeiro pedido curto. Depois acrescente formato de personagem, lore e contexto longo, uma mudança por vez.
Abra as chaves de API do Google AI Studio, entre na conta, escolha Get API Key, aceite os termos, crie a chave e copie-a. Trate-a como senha. Não a coloque em um card de personagem ou captura pública.
No SillyTavern abra API Connections. Selecione Chat Completion, depois Google AI Studio, cole a chave em API Key e clique em Connect. Vertex AI é outro provider com outra autenticação.
Selecione `gemini-2.5-flash-lite` na lista retornada. Se digitar manualmente, use o ID estável exato. Não use o alias preview encerrado.
Use uma mensagem curta e um card compacto. Mantenha streaming igual durante o teste e anote provider, modelo, tamanho do contexto e estado da resposta.
Depois que o texto simples funcionar, acrescente a instrução de sistema, formato e lore. Se marcadores aparecerem na resposta, confira o template do conector antes dos samplers.
O Google aplica RPM, TPM e RPD ao projeto. Outra chave do mesmo projeto não cria uma cota nova.
FORMATO DO PEDIDO
O exemplo REST oficial do Google usa um cabeçalho de chave e JSON. O SillyTavern constrói seu pedido ao provider, então isto explica conceitos da API e não é uma lista de campos da interface.
POST https://generativelanguage.googleapis.com/v1beta/interactions
Headers: x-goog-api-key: $GEMINI_API_KEY
Content-Type: application/json
Body: {
"model": "gemini-2.5-flash-lite",
"input": "Responda em uma frase curta."
}Formato REST mínimo da documentação do Google
Quando o conector permitir, separe a instrução de sistema do turno do usuário. Não suponha que os campos de Chat Completion correspondem exatamente ao JSON REST do Google.
O Google lista suporte a thinking e saída máxima de 65.536 tokens. Use apenas configurações documentadas pelo conector atual do SillyTavern.
O Google documenta streaming com `stream: true` e SSE. Se a resposta vier vazia, repita o teste curto sem streaming para separar um problema de exibição ou parsing.
SOLUÇÃO DE PROBLEMAS
Comece pelo código, provider e modelo do pedido. Mude uma variável por vez e proteja a chave.
| Sinal | Confira primeiro | Próximo passo |
|---|---|---|
| 400 INVALID_ARGUMENT | Nome do modelo, JSON, ordem das mensagens e configurações não suportadas. | Volte ao prompt mínimo. Remova uma configuração opcional e depois a adicione sozinha. |
| 401 UNAUTHENTICATED | Valor da chave, cabeçalho, espaços e provider escolhido. | Copie ou crie a chave novamente no AI Studio, reconecte o Google AI Studio e não misture credenciais do Vertex. |
| 403 PERMISSION_DENIED | Acesso do projeto, estado da API, região ou resposta de policy. | Confira o projeto Google e o estado do AI Studio. Não contorne controles de segurança. |
| 404 NOT_FOUND | ID exato do modelo e endpoint do provider. | Use `gemini-2.5-flash-lite`, remova o alias preview encerrado e atualize a lista. |
| 429 RESOURCE_EXHAUSTED | RPM, TPM, RPD e nível de cobrança do projeto no AI Studio. | Espere, reduza frequência, contexto ou saída e consulte as cotas. Outra chave do mesmo projeto pode não mudar nada. |
| 200, mas vazio | Parser de streaming, detalhes de finalização, feedback de segurança, formato e campo de texto. | Teste um prompt curto sem streaming e confira console e resposta antes de alterar o card. |
TABBIT COMO CONTEXTO
O Tabbit não executa seu provider do SillyTavern nem aceita sua chave do Google AI Studio. Ele serve para páginas de referência, personagens, capturas, PDFs e tarefas do navegador.
Deixe uma wiki canon, documentação ou nota de cenário em uma aba visível. O Tabbit pode resumir a página no painel lateral.
Referencie uma página, captura ou arquivo local com @ para pedir um resumo ou checar continuidade, sem colar cada parágrafo.
O snapshot de produção internacional atual lista e habilita `gemini-2.5-flash-lite`. Conta, edição, cota e implantações futuras podem variar. Use o picker ao vivo. Tabbit não é a conexão do SillyTavern.

DOIS TRABALHOS DIFERENTES
O SillyTavern cuida do card e do pedido ao provider. O Tabbit cuida do contexto do navegador e do assistente nativo. Essa fronteira evita transformar um campo inexistente em uma etapa falsa.

| Necessidade | SillyTavern + Google AI Studio | Tabbit |
|---|---|---|
| Chave Gemini | Crie no AI Studio e cole no provider Google AI Studio. | Não há campo para essa chave. |
| ID estável | Escolha `gemini-2.5-flash-lite` na lista atual. | Use os modelos que o Tabbit realmente listar. |
| Cards e lore | Use controles, templates e contexto de RP. | Referencie wiki, nota ou arquivo em uma aba. |
| Pesquisa na web | Adicione contexto com seu fluxo de ST. | Use @ com páginas, capturas e arquivos. |
| Ações Agent | Dependem da configuração do SillyTavern. | Use o modo Agent para tarefas web compatíveis. |
REFERÊNCIAS OFICIAIS
FAQ
Use `gemini-2.5-flash-lite`. O Google marca `gemini-2.5-flash-lite-preview-09-2025` como encerrado.
Abra API Connections, selecione Chat Completion e Google AI Studio, cole a chave do AI Studio e conecte. Vertex AI é outro provider.
O Google publica um guia de compatibilidade, mas o comportamento do provider no SillyTavern pode variar. Comece pelo provider Google AI Studio documentado e use compatibilidade apenas se a documentação e o conector atuais aceitarem.
Os limites RPM, TPM e RPD do Google são do projeto. Confira uso e nível no AI Studio, espere ou reduza frequência, contexto e saída.
Teste um prompt curto sem streaming e confira console, finalização, segurança e formato do conector. Não altere o card primeiro.
O Google documenta 1.048.576 tokens de entrada e 65.536 de saída. São tetos, não uma garantia de recuperar todos os detalhes antigos igualmente.
O Google lista o recurso como compatível. O conector atual do SillyTavern pode mostrar controles diferentes. Se um campo não estiver documentado, mantenha o padrão do provider.
Não. O Tabbit não aceita esse provider nem a chave do Google AI Studio. Mantenha essa conexão no SillyTavern.
Conecte Gemini 2.5 Flash-Lite no SillyTavern. Use Tabbit quando a conversa depender de páginas, arquivos ou ações do navegador.
Disponível para macOS e Windows. Os modelos e providers do Tabbit podem mudar.