Mistral Small 3.2 24B
공식 instruct checkpoint
정확한 지시, 다국어 채팅, Apache-2.0 기준점에 적합합니다.
RP 튜닝 모델보다 문학적 표현과 선제성이 약하게 느껴질 수 있습니다.
모델 카드 열기 ↗MISTRAL 24B / RP 가이드
맞는 모델은 캐릭터 카드, 하드웨어, 원하는 문체에 따라 달라집니다. 먼저 전체 저장소 ID를 적고 캐릭터 목소리, 일관성, 주도성, 반복, 컨텍스트, 라이선스를 비교하세요. 공식 사실과 커뮤니티 보고를 분리했습니다.

조건부 결론
검증 가능한 출발점이지 전체 순위표는 아닙니다. 카드와 댓글은 서로 다른 조건에서 나온 것이므로 자신의 카드로 다시 확인하세요.
공식 instruct checkpoint
정확한 지시, 다국어 채팅, Apache-2.0 기준점에 적합합니다.
RP 튜닝 모델보다 문학적 표현과 선제성이 약하게 느껴질 수 있습니다.
모델 카드 열기 ↗커뮤니티 RP 튜닝
문체, 이야기 주도성, 유연한 시스템 프롬프트를 중시한다면 시험할 후보입니다.
고유한 템플릿과 샘플러가 있습니다. 인용된 호평은 표준 벤치마크가 아닙니다.
모델 카드 열기 ↗Mistral Small 3.2 기반 RP 튜닝
캐릭터 목소리, 그룹 채팅, 장면 전개를 비교할 때 유용합니다.
카드에는 물리나 인과 관계의 작은 오류가 언급됩니다. Heretic 변형은 별도 산출물입니다.
모델 카드 열기 ↗롤플레이 우선 merged LoRA
몰입형 서술, 강한 캐릭터 목소리, 장면의 추진력을 목표로 합니다.
긴 생성의 반복, 사용자 캐릭터 대신 말하기, 엄격한 다중 캐릭터 형식이 약점으로 적혀 있습니다.
모델 카드 열기 ↗GGUF 파일이 있는 RP 튜닝
llama.cpp 또는 GGUF를 쓰며 파일 크기를 선택하려는 로컬 사용자에게 맞습니다.
Q4, Q6, Q8은 메모리, 속도, 충실도의 교환입니다. 공식 새 릴리스는 아닙니다.
모델 카드 열기 ↗선택 기준
실제 세션에 영향을 주는 항목을 평가합니다. 첫 답변이 멋져도 16k에서 조연을 잊는다면, 평범해도 기억이 안정적인 모델이 더 나을 수 있습니다.
| 기준 | 공식 3.2 | 커뮤니티 RP | 적합한 용도 |
|---|---|---|---|
| 캐릭터 일관성 | 지시 따르기가 안정적 | 목소리는 강하지만 8에서 16k로 확인 | 장기 카드 |
| 문체와 주도성 | 절제되고 직접적 | Magidonia, Cydonia, Umbra는 창작 추진을 강조 | 문학 장면 |
| 반복 | 3.2는 3.1보다 무한 생성이 약 2배 적다고 보고 | 튜닝, 양자화, 샘플러에 따라 다름 | 긴 출력 |
| 컨텍스트 | 3.2 계열은 128k 지원을 표시 | 실제 KV cache는 백엔드와 양자화에 좌우 | 로어가 많은 대화 |
| 하드웨어 | BF16/FP16 GPU 약 55GB | GGUF는 Q4_K_S 13.6GB부터 Q8_0 25.2GB | 로컬 실행 |
| 라이선스와 최신성 | Apache 2.0, 공식 ID 명확 | 카드, 기반 모델, 날짜, 변형을 따로 확인 | 공유와 배포 |
선택 점수 = 0.30 × 카드 적합성 + 0.20 × 목소리 + 0.20 × 일관성 + 0.15 × 컨텍스트 + 0.10 × 하드웨어 + 0.05 × 라이선스 신뢰도. 용도에 따라 비중을 바꾸세요.
재현 가능한 테스트
서로 다른 프롬프트로 base와 RP 튜닝을 비교하지 마세요. 캐릭터, 장면, 컨텍스트와 출력 한도를 고정하고 프롬프트와 양자화 파일을 결과와 함께 저장하세요.
같은 카드, 설정, 시작 행동을 줍니다. 어휘, 시점, 주도성, 사용자 캐릭터 경계를 확인하세요.
작은 사실, 새로운 감정, 두 번째 캐릭터를 넣습니다. 망각, 반복, 갑작스러운 톤 변화, 원치 않는 행동을 표시하세요.
일관성, 문체, 사용자 주도권, 반복, 지연을 1에서 5로 평가하고 temperature, top_p, 컨텍스트, 양자화, 백엔드를 적으세요.
카드와 컴퓨터에 모두 맞는 후보를 남깁니다. 템플릿이나 양자화를 바꿔 다시 테스트한 뒤 제외하세요.

로컬 설정 확인
약한 답변처럼 보여도 원인은 모델 가중치보다 앞단에 있을 수 있습니다. 생성값을 바꾸기 전에 ID, 형식, chat template을 확인하세요.
3.2, 3.1, base, instruct, Magidonia, Cydonia, Umbra는 서로 다른 결과물입니다. "Mistral 24B"만으로는 부족합니다.
3.2 카드는 BF16/FP16에 약 55GB GPU를 적습니다. GGUF 크기는 양자화에 따라 달라지고 KV cache와 컨텍스트 여유도 필요합니다.
Mistral 카드가 안내하는 tokenizer와 채팅 형식을 사용하세요. `<s>`나 역할 토큰이 보이면 중복 템플릿 적용을 제거합니다.
공식 카드는 일반 사용에 낮은 temperature를 권합니다. RP 튜닝은 다를 수 있습니다. 프롬프트를 고정하고 한 값씩 바꾸세요.
TABBIT 연구 데스크
Tabbit은 Mistral 24B를 실행하지 않으며 로컬 RP 프론트엔드를 대신하지 않습니다. 이 가이드 확인 시 Tabbit 공개 모델 목록에는 Mistral이 보이지 않았습니다. 공식 카드, 양자화 페이지, Reddit 메모와 결과를 모으는 데 사용하세요.
정확한 ID, 라이선스와 업데이트 날짜를 가까운 탭에 두고 근거와 개인 취향을 구분하세요.
카드, 캡처, 로컬 메모를 질문에 넣고 ID를 보존하며 모르는 점을 표시하는 체크리스트를 요청하세요.
Tabbit은 여러 모델의 답변을 비교하고 출처를 요약할 수 있습니다. 선택기 목록은 바뀌므로 설치 뒤 확인하세요.


모델 데스크
ID는 보이게, 출처는 가까이. 브라우저가 실험 노트가 됩니다.
위의 출처 카드는 확인한 내용을 기록한 것입니다. 모든 엔드포인트나 모델이 계속 제공된다는 약속으로 보지는 마세요.
FAQ
자료가 뒷받침하는 단일 승자는 없습니다. Small 3.2를 기준으로 삼고 Magidonia, Cydonia, Umbra, Roleplay V3를 자신의 카드로 시험하세요.
검색 결과에서는 36B 업스케일과 31B 커뮤니티 모델로 나타납니다. Mistral Small 24B에서 왔더라도 24B checkpoint는 아닙니다.
커뮤니티 카드는 Magidonia와 Cydonia의 일관성을 좋게 평가하고 Umbra는 목소리와 장면 추진을 강조합니다. 정성 보고이므로 두 턴 테스트를 하세요.
컨텍스트까지 포함해 감당할 수 있는 가장 높은 품질을 고르세요. Roleplay V3 GGUF 페이지는 Q4_K_S 13.6GB, Q4_K_M 14.4GB, Q6_K 19.4GB, Q8_0 25.2GB를 제시합니다.
그렇게 가정하지 마세요. 확인 당시 Tabbit 공개 모델 목록에는 Mistral이 없었습니다. 여기서는 자료 수집과 비교 용도로 소개합니다.
checkpoint, 양자화, 프롬프트와 결과를 함께 보관하면 새 릴리스를 비교하고 문제 세션을 진단하기 쉽습니다.
macOS와 Windows 지원. Tabbit 모델 목록은 바뀔 수 있습니다.