官方实体
MiMo-V2.5-Pro 是 Xiaomi MiMo 的开源 Mixture-of-Experts 模型。它不是 MiMo-V2-Flash、MiMo-V2-Pro,也不是小米手机助手。
先核对模型名
MiMo-V2.5-Pro 是小米 MiMo 的开源 Pro 模型,官方 API 标签为 `mimo-v2.5-pro`。本页先确认实体,再接通 endpoint,最后把 RP 设置与 provider 行为分开排查。
注意:当前 Tabbit 模型清单没有 MiMo-V2.5-Pro。本页不承诺 Tabbit 原生提供 MiMo 接口。

身份核对
搜索结果会把模型家族、本地权重和路由 slug 混在一起。官方页面提供了清晰基准。
MiMo-V2.5-Pro 是 Xiaomi MiMo 的开源 Mixture-of-Experts 模型。它不是 MiMo-V2-Flash、MiMo-V2-Pro,也不是小米手机助手。
小米将发布日期写为 2026 年 4 月 27 日。Pro 版总参数 1.02T、active 参数 42B,上下文窗口 1M token。
模型面向 agentic 工作、复杂软件工程和长程任务。厂商案例不等于 SillyTavern 角色扮演跑分。
| 核对项 | MiMo-V2.5-Pro | 不要替换成 |
|---|---|---|
| API 模型标签 | `mimo-v2.5-pro` | `mimo-v2-flash` 或路由别名 |
| 上下文 | 官方 Pro 模型卡写 1M token | provider 可能设置更低上限 |
| Thinking | 由 provider 和服务层决定字段 | 不要假设有统一 ST 开关 |
| 权重 | Hugging Face 的 XiaomiMiMo/MiMo-V2.5-Pro | MiMo-V2.5 标准版或 V2-Flash 权重 |
SILLYTAVERN 接入
SillyTavern 官方文档支持 Chat Completions 和自定义 OpenAI-compatible endpoint。按这个顺序操作,避免把 provider 错误误判成提示词问题。
使用小米 API,或当前列出 `mimo-v2.5-pro` 的渠道。先确认 endpoint、鉴权、上下文上限、工具支持和模型列表。
在 SillyTavern 选择 Chat Completion API 类型,按渠道提供的内容填写 base URL 和 API Key。
遵循小米标签的渠道使用 `mimo-v2.5-pro`。部分路由会要求带命名空间的 slug,直接复制渠道给出的精确 ID。
先加载一张简短角色卡,用 Test Message 测试。确认回复、token 统计和停止行为后,再导入大型 lorebook。
官方模型卡给出的本地部署参考是 temperature=1.0、top_p=0.95。这不是所有 API 或 SillyTavern 预设的保证。
角色扮演调参
模型卡描述了长程连贯性。SillyTavern 的实际请求还会包括角色卡、世界信息、作者注释、示例、聊天记录和 reasoning 内容。
把角色语气、边界和当前场景规则分成清楚的小段。不要让重复的全局指令淹没当前场景。
1M 是模型上限,不是 provider 必然开放的额度。聊天越长,留给新回复的空间越少。
如果 endpoint 暴露 reasoning 字段,单独测试。不要假设隐藏字段、可见思维或 token 预算在不同 provider 上相同。
固定角色和提示词,分别测试后处理、temperature、top_p 或 reasoning,再比较几轮输出。
排错
第一条消息失败通常落在几类问题里。根据响应和 provider 日志决定下一步。
检查 API Key、账号权限和 base URL。模型名正确也无法修复鉴权失败。
向 provider 确认精确模型 ID。`mimo-v2.5-pro` 是官方标签,但路由可能需要命名空间,或根本未开放 Pro。
减少 lorebook、示例消息和历史记录,并确认 provider 的实际上限,不要只依据小米的 1M 规格。
先尝试限制较少的后处理,再用短角色卡测试。若 endpoint 要求单 system 消息或角色交替,按其 schema 调整。
确认路由是否支持工具调用和 reasoning 字段。小米的 agent 案例不能证明每个 API 或 SillyTavern 连接都暴露这些能力。
当前 Tabbit
本页检查到的 Tabbit 模型清单没有 MiMo-V2.5-Pro,因此它不是原生 MiMo 客户端。当资料在 wiki、提示词指南、参考页、截图或文件里时,Tabbit 可以让已列出的模型在旁边工作。
下载 macOS 或 Windows 版 Tabbit,打开新标签页。
使用当前模型选择器。列表会随产品更新变化,只选择界面实际显示的模型。
输入 `@` 把打开的网页、截图或文件带进对话,不离开原始资料。

上下文工作流
需要角色卡和 lorebook 时,SillyTavern 仍是专用选择。网页研究和参考资料则可以交给 Tabbit,不必反复复制每一段。
主视图打开来源,右侧 AI 面板总结或提取场景细节,页面保持可见。

Tabbit 可以并排显示当前清单模型的回复。截图展示的是比较界面,不是 MiMo 专属结果。

客户端选择
角色状态交给专用 RP 前端,网页或文档来源则可以留在 Tabbit 里,和回答同时可见。
| 能力 | SillyTavern | Tabbit |
|---|---|---|
| 角色卡和 lorebook | 核心流程 | 没有内置角色卡栈 |
| Provider 控制 | Endpoint、预设、采样和后处理 | 使用产品实际列出的模型 |
| 网页上下文 | 粘贴或使用兼容扩展 | 用 `@` 引用打开的标签页 |
| Reasoning 控制 | 取决于连接和 provider schema | 取决于选择的模型 |
| 适合场景 | 以角色为中心的 RP | 研究、读资料和浏览器对话 |
常见问题
小米官方页面称它为 MiMo-V2.5-Pro,发布页写明 API 模型标签使用 `mimo-v2.5-pro`。
不是。它们是 Xiaomi MiMo 的不同模型条目。要接 Pro 时不要填 Flash 路由 slug。
官方模型页和 Hugging Face 模型卡写的是 1M token。provider 仍可能开放更小的请求上限。
本页不推荐所谓通用预设。先用短角色卡确认连接,再一次调整一个变量。
只有当 provider 为该模型记录了 reasoning 或 thinking 字段时才测试。小米的 agent 介绍不等于统一的 ST 开关。
可能需要命名空间、路由已经下线,或 provider 暴露的是其他模型。检查当前模型列表和错误响应。
本页检查到的当前可见模型清单没有 MiMo-V2.5-Pro。Tabbit 的真实价值是用它实际列出的模型处理网页上下文,不是承诺 MiMo endpoint。
不能。角色卡、lorebook 和 RP 控制仍适合 SillyTavern。Tabbit 更适合作为网页、文件和模型比较的辅助路径。
先用 provider 验证 `mimo-v2.5-pro`,再用短角色卡测试,把 thinking 和上下文上限视为连接能力。缺少的是实时网页来源时,在 Tabbit 打开页面,用清单中的模型在旁边对话。
支持 macOS 和 Windows。模型选择器与 provider 可用性会变化。