Gemma 4 31B × SillyTavern

SillyTavern에서 Gemma 4 31B 사용하기

Gemma 4 31B로 캐릭터 채팅을 시작하려면 공식 모델명과 양자화 파일을 구분하세요. 그 다음 backend, template, tokenizer, thinking 순서로 확인합니다.

Gemma 4 공식 페이지
공식 이름과 템플릿 확인
세로 탭과 중앙 입력창, 오른쪽 채팅 패널이 보이는 Tabbit 데스크톱 새 탭.

모델부터 확인

Gemma 4는 SillyTavern 프리셋 하나가 아니라 모델군입니다

Google은 E2B, E4B, 12B, 26B A4B, 31B를 공개합니다. 26B A4B는 mixture-of-experts이고 31B는 dense입니다. Q4와 Q6는 양자화 버전이지 새 공식 모델명이 아닙니다.

01

26B A4B와 31B 중 무엇을 고를까

model card와 보유 하드웨어를 기준으로 고르세요. 26B A4B는 일부만 활성화되어 가벼울 수 있고 31B는 메모리를 더 요구합니다.

02

로컬, 공급자, API

Ollama, LM Studio, KoboldCpp, llama.cpp는 템플릿과 컨텍스트 처리 방식이 다릅니다. API를 쓸 때는 공급자의 정확한 모델 ID를 사용하세요.

03

롤플레이는 설정 테스트

캐릭터 일관성은 checkpoint뿐 아니라 카드, system prompt, sampler, 컨텍스트에 좌우됩니다. DRY와 프리셋은 커뮤니티의 시작점입니다.

SillyTavern 경로

연결은 이 순서로 점검하세요

한 번에 한 레이어만 바꾸면 잘못된 응답의 원인을 찾기 쉽습니다.

  1. 01

    1. 엔드포인트 확인

    백엔드에 맞는 커넥터를 고르고 정확한 checkpoint가 목록에 있는지 확인하세요. 공급자의 model slug를 그대로 복사하세요.

  2. 02

    2. Chat Completions 선택

    지원하는 API나 서버라면 먼저 Chat Completions를 사용하세요. Text Completion은 템플릿을 더 많이 직접 관리해야 합니다.

  3. 03

    3. tokenizer와 템플릿 맞추기

    백엔드가 제공하는 Gemma 4 또는 Gemini tokenizer/template을 사용하세요. 오래된 템플릿은 thinking 마커를 잘못 배치할 수 있습니다.

  4. 04

    4. 카드와 프리셋 추가

    카드를 먼저 넣고 간결한 system prompt를 추가하세요. 커뮤니티 프리셋은 하나씩 시험하고 변경 사항을 기록하세요.

FF와 Moonlight는 커뮤니티에서 나온 이름입니다. Google 기본값이 아니며 파일을 재배포하지 않습니다.

응답이 이상할 때

실패한 레이어만 고치세요

CASE 01

thinking이 일반 텍스트로 보임

템플릿, tokenizer, thinking 설정부터 확인하세요. <|think|>는 백엔드에 따라 달라서 형식이 맞지 않으면 토큰이 그대로 보일 수 있습니다.

CASE 02

가끔만 생각함

공급자와 로컬 빌드는 reasoning을 다르게 노출할 수 있습니다. 짧은 요청을 thinking on/off로 비교한 뒤 안내 문서를 확인하세요.

CASE 03

캐릭터가 반복되거나 흐트러짐

온도를 바꾸기 전에 중복 컨텍스트를 줄이세요. 카드 중복과 한도를 확인한 뒤 DRY나 sampler를 시험하세요.

브라우저 경로

캐릭터 페이지를 열어 둔 채 옆에서 질문하세요

Tabbit은 SillyTavern 카드나 lorebook을 대체하지 않습니다. 위키나 문서를 읽으면서 브라우저에 표시된 모델과 대화하는 도구입니다.

  1. 1

    Tabbit 설치

    macOS 또는 Windows용 Chromium 기반 브라우저를 받으세요. 로컬 모델 파일이나 SillyTavern 서버가 필요하지 않습니다.

  2. 2

    현재 목록의 모델 선택

    설치 후 모델 선택기를 열고 GPT-5.4, GPT-5.2-Chat, Gemini-3-Flash처럼 실제로 보이는 모델을 고르세요. 목록이 기준입니다.

  3. 3

    페이지 참조

    캐릭터 위키나 설정 문서를 탭에 남기세요. @로 페이지, 스크린샷, 파일을 참조하고 장면 메모나 다른 초안을 요청할 수 있습니다.

GPT-5.4, GPT-5.2-Chat, Gemini-3.1-Pro, Gemini-3-Flash, Claude-Sonnet-4.6이 보이는 Tabbit 모델 선택기. Gemma 4는 이 캡처에 없습니다.

도구 선택

SillyTavern과 Tabbit 중 무엇을 쓸까

막힌 지점에 맞춰 고르세요. 브라우저는 카드 관리자가 아니며 로컬 프론트엔드가 모델을 자동으로 개선하지도 않습니다.

SillyTavernTabbit
캐릭터 카드와 lorebook내장원본 페이지를 열어 둠
로컬 Gemma 4 checkpoint백엔드 직접 준비목록의 모델 선택
템플릿과 sampler세밀한 제어모델이 관리
페이지 컨텍스트붙여넣기 또는 확장@ 탭 또는 파일
첫 유용한 답변설치 + endpoint + preset설치 + 모델 선택
GPT-5.4, GPT-5.2-Chat, Gemini-3.1-Pro, Gemini-3-Flash, Claude-Sonnet-4.6이 보이는 Tabbit 모델 선택기. Gemma 4는 이 캡처에 없습니다.

페이지 참조

캐릭터 위키나 설정 문서를 탭에 남기세요. @로 페이지, 스크린샷, 파일을 참조하고 장면 메모나 다른 초안을 요청할 수 있습니다.

GPT-5.4, GPT-5.2-Chat, Gemini-3.1-Pro, Gemini-3-Flash, Claude-Sonnet-4.6이 보이는 Tabbit 모델 선택기. Gemma 4는 이 캡처에 없습니다.

페이지 컨텍스트

@ 탭 또는 파일

FAQ

Gemma 4와 SillyTavern 질문

Gemma 4 26B와 31B는 같은 모델인가요?+

아닙니다. Google은 26B A4B를 mixture-of-experts, 31B를 dense로 설명합니다.

어떤 양자화를 받아야 하나요?+

메모리, 컨텍스트와 배포자의 model card에 맞춰 Q4, Q5, Q6를 고르세요.

thinking token이 텍스트로 나오는 이유는?+

tokenizer, 템플릿, 백엔드, 공급자의 형식이 맞지 않을 수 있습니다. 먼저 이 네 가지를 확인하세요.

Tabbit에서 Gemma 4를 실행할 수 있나요?+

가정하지 마세요. 설치 후 현재 선택기에 표시되는 모델만 사용하세요.

Tabbit이 SillyTavern을 대체하나요?+

아닙니다. 카드와 lorebook, 상세 프리셋은 SillyTavern에 맞고 Tabbit은 페이지 옆 대화에 맞습니다.

잘못된 레이어를 고치지 마세요

로컬 Gemma 4는 model card와 템플릿 연결을 확인하세요. 위키 옆에서 바로 대화하려면 Tabbit을 설치하고 현재 목록에서 모델을 고르세요.

macOS와 Windows 지원. 모델 목록은 바뀔 수 있습니다.

© 2026 Tabbit Browser. 당신의 맥락을 이해하는 AI 네이티브 브라우저.