안정 ID
`gemini-2.5-flash-lite`를 사용하세요. Google은 `gemini-2.5-flash-lite-preview-09-2025`를 종료된 모델로 표시합니다. temperature를 바꿔도 종료된 ID는 고쳐지지 않습니다.
GEMINI API × SILLYTAVERN
Google AI Studio를 통해 SillyTavern에서 안정 버전 Gemini 2.5 Flash-Lite를 사용하세요. provider, 키, 정확한 모델 ID, 첫 요청, thinking과 정상 연결을 고장처럼 보이게 하는 오류를 확인합니다.

모델 확인
Google은 Gemini 2.5 Flash-Lite를 안정적이고 빠른 멀티모달 모델로 안내합니다. 텍스트, 이미지, 동영상, 오디오와 PDF를 입력하고 텍스트를 출력합니다. 큰 컨텍스트 한도가 프로젝트 할당량이나 provider 검사를 없애지는 않습니다.
`gemini-2.5-flash-lite`를 사용하세요. Google은 `gemini-2.5-flash-lite-preview-09-2025`를 종료된 모델로 표시합니다. temperature를 바꿔도 종료된 ID는 고쳐지지 않습니다.
모델 페이지의 입력 한도는 1,048,576 tokens, 출력 한도는 65,536 tokens입니다. 실제 RPM, TPM, RPD는 Google 프로젝트와 사용 등급에 따라 달라집니다.
Google은 thinking, 함수 호출, 구조화된 출력, URL context, Search grounding, 코드 실행, 캐시와 파일 검색을 지원한다고 안내합니다. SillyTavern에 표시되는 옵션은 더 적을 수 있습니다.
무료와 유료 사용의 한도는 다릅니다. 긴 RP 세션 전에 AI Studio 사용량과 가격을 확인하세요. 무료가 무제한이라는 뜻은 아닙니다.

SILLYTAVERN 설정
SillyTavern 공식 가이드는 Google AI Studio를 Chat Completion에서 선택하도록 안내합니다. 첫 요청은 짧게 유지하세요. 텍스트가 반환된 뒤 캐릭터 형식, lore와 긴 컨텍스트를 하나씩 추가합니다.
Google AI Studio API keys를 열고 로그인한 뒤 Get API Key를 선택합니다. 약관에 동의하고 키를 만든 후 복사하세요. 비밀번호처럼 보관하고 캐릭터 카드나 공개 캡처에 넣지 마세요.
SillyTavern에서 API Connections를 열고 Chat Completion, Google AI Studio를 차례로 선택합니다. API Key에 붙여 넣고 Connect를 누르세요. Vertex AI는 다른 provider와 인증 방식입니다.
반환된 목록에서 `gemini-2.5-flash-lite`를 선택합니다. 직접 입력할 때도 정확한 안정 ID를 쓰고 종료된 preview alias는 사용하지 마세요.
짧은 사용자 메시지와 작은 캐릭터 카드로 테스트합니다. 테스트 중 streaming 상태를 일정하게 유지하고 provider, 모델, 컨텍스트 크기와 응답 상태를 기록하세요.
일반 텍스트가 작동한 뒤 system instruction, 메시지 형식과 lore를 추가합니다. 응답에 템플릿 표시가 나오면 sampler보다 connector template을 먼저 확인하세요.
Google의 RPM, TPM, RPD 제한은 프로젝트 단위입니다. 같은 프로젝트의 새 키로 할당량이 늘지 않습니다.
요청 형태
Google 공식 REST 예제는 API key 헤더와 JSON을 사용합니다. SillyTavern은 provider 요청을 직접 만들므로 이 예제는 API 개념 확인용이며 UI 필드 목록이 아닙니다.
POST https://generativelanguage.googleapis.com/v1beta/interactions
Headers: x-goog-api-key: $GEMINI_API_KEY
Content-Type: application/json
Body: {
"model": "gemini-2.5-flash-lite",
"input": "한 문장으로 짧게 답하세요."
}Google 문서의 최소 REST 형태
connector가 지원하면 system instruction을 사용자 턴과 분리하세요. Chat Completion 필드가 Google REST JSON과 정확히 일치한다고 가정하지 마세요.
Google은 thinking 지원과 최대 65,536 출력 tokens를 안내합니다. 현재 SillyTavern connector가 문서화한 설정만 사용하세요.
Google은 `stream: true`와 SSE를 통한 스트리밍을 문서화합니다. 빈 응답이면 streaming을 끈 짧은 테스트로 화면 또는 파싱 문제를 분리하세요.
문제 해결
상태 코드, provider와 요청의 모델부터 확인합니다. 한 번에 하나만 바꾸고 키는 보호하세요.
| 신호 | 먼저 확인 | 다음 조치 |
|---|---|---|
| 400 INVALID_ARGUMENT | 모델 이름, JSON, 메시지 순서와 지원되지 않는 설정. | 최소 프롬프트로 돌아가 선택 설정 하나를 제거한 뒤 하나씩 되돌립니다. |
| 401 UNAUTHENTICATED | 키, 헤더, 공백과 선택한 provider. | AI Studio에서 키를 다시 복사하거나 만들고 Google AI Studio에 재연결합니다. Vertex 자격 증명을 섞지 마세요. |
| 403 PERMISSION_DENIED | 프로젝트 권한, API 상태, 지역 또는 policy 응답. | Google 프로젝트와 AI Studio 상태를 확인합니다. 보안 또는 접근 제어를 우회하지 마세요. |
| 404 NOT_FOUND | 정확한 모델 ID와 provider endpoint. | `gemini-2.5-flash-lite`를 사용하고 종료된 preview alias를 지운 뒤 목록을 새로 고칩니다. |
| 429 RESOURCE_EXHAUSTED | AI Studio 프로젝트의 RPM, TPM, RPD와 결제 등급. | 기다리고 빈도, 컨텍스트, 출력을 줄인 뒤 현재 할당량을 확인합니다. 같은 프로젝트의 새 키로 해결되지 않을 수 있습니다. |
| 200인데 비어 있음 | streaming parser, 종료 정보, 안전 피드백, 형식과 실제 텍스트 필드. | streaming을 끈 짧은 프롬프트를 보내고 카드 변경 전에 콘솔과 응답 상세를 확인하세요. |
TABBIT을 컨텍스트로
Tabbit은 SillyTavern provider를 실행하지 않으며 Google AI Studio API 키도 받지 않습니다. 소스 페이지, 캐릭터 참고자료, 캡처, PDF와 브라우저 작업에 적합합니다.
canon wiki, 문서 또는 설정 노트를 보이는 탭에 둡니다. Tabbit은 사이드 패널에서 페이지를 요약할 수 있습니다.
요약이나 연속성 확인이 필요하면 @로 열린 페이지, 캡처 또는 로컬 파일을 참조하세요. 모든 문단을 붙여 넣을 필요가 없습니다.
현재 국제판 프로덕션 스냅샷에는 `gemini-2.5-flash-lite`가 표시되고 활성화되어 있습니다. 계정, edition, 할당량과 향후 배포는 다를 수 있으니 실시간 picker를 사용하세요. Tabbit은 SillyTavern 연결이 아닙니다.

서로 다른 두 작업
SillyTavern은 캐릭터 카드와 provider 요청을 관리합니다. Tabbit은 브라우저 컨텍스트와 브라우저 내 도우미를 관리합니다. 경계를 지키면 없는 키 입력창을 잘못된 단계로 만들지 않습니다.

| 필요한 것 | SillyTavern + Google AI Studio | Tabbit |
|---|---|---|
| Gemini API 키 | AI Studio에서 만들고 Google AI Studio provider에 붙여 넣습니다. | 이 연결용 키 입력창이 없습니다. |
| 안정 모델 ID | 실시간 목록에서 `gemini-2.5-flash-lite`를 선택합니다. | Tabbit이 실제로 표시하는 모델을 사용합니다. |
| 캐릭터 카드와 lore | RP 제어, 템플릿과 컨텍스트 설정을 사용합니다. | 탭의 wiki, 노트 또는 파일을 참조합니다. |
| 웹 조사 | ST 워크플로로 컨텍스트를 추가합니다. | @로 페이지, 캡처와 파일을 참조합니다. |
| Agent 작업 | SillyTavern 설정에 따라 다릅니다. | 지원되는 웹 작업에 브라우저 Agent를 사용합니다. |
FAQ
`gemini-2.5-flash-lite`를 사용합니다. `gemini-2.5-flash-lite-preview-09-2025`는 종료되었습니다.
API Connections에서 Chat Completion, Google AI Studio를 선택하고 AI Studio 키를 붙여 넣어 연결합니다. Vertex AI는 별도 provider입니다.
Google이 호환 가이드를 제공하지만 SillyTavern provider 동작은 다를 수 있습니다. 먼저 공식 문서가 있는 Google AI Studio provider를 쓰고 현재 문서와 connector가 지원할 때만 호환 경로를 사용하세요.
Google의 RPM, TPM, RPD 제한은 프로젝트 기준입니다. AI Studio 사용량과 등급을 확인한 후 기다리거나 빈도, 컨텍스트와 출력을 줄이세요.
streaming을 끈 짧은 프롬프트를 테스트하고 콘솔, 종료 정보, 안전 피드백과 connector 형식을 확인하세요. 먼저 캐릭터 카드를 바꾸지 마세요.
Google은 입력 1,048,576 tokens와 출력 65,536 tokens를 문서화합니다. 이는 상한이며 오래된 모든 세부사항을 동일하게 불러온다는 보장은 아닙니다.
Google은 thinking을 지원한다고 안내합니다. 현재 connector가 노출하는 제어는 다를 수 있습니다. 문서화되지 않은 필드는 provider 기본값을 유지하세요.
아니요. Tabbit은 SillyTavern provider나 Google AI Studio 키를 받지 않습니다. 이 연결은 SillyTavern에 두세요.
Gemini 2.5 Flash-Lite는 SillyTavern에서 연결하세요. 대화에 웹 페이지, 파일 또는 브라우저 작업이 필요할 때 Tabbit을 사용하세요.
macOS와 Windows에서 사용 가능합니다. Tabbit 모델 및 provider 지원은 바뀔 수 있습니다.