MIMO 2.5 PRO API

Corrige la conexión de MiMo 2.5 Pro campo por campo

Una solicitud válida necesita el host correcto de Xiaomi, el encabezado api-key, el ID exacto del modelo y un cuerpo que MiMo acepte. Esta guía empieza por los síntomas y luego revisa thinking, streaming, contexto y proveedor.

Documentación oficial comprobada el 27/08/2026. MiMo-V2.5-Pro no aparece en el selector actual de Tabbit, así que Tabbit se presenta como una ruta independiente con modelos compatibles.

Nueva pestaña de Tabbit en escritorio con un cuadro de chat central y un panel Chat a la derecha.

LO QUE DICEN LOS DOCUMENTOS

La mayoría de fallos son desajustes del contrato

Xiaomi documenta dos familias de Base URL, un ID de modelo y compatibilidad con OpenAI y Anthropic. Los resultados de la comunidad señalan rechazos de proveedores y llamadas que consumen tokens de entrada sin devolver una salida útil, pero no son garantías del servicio.

01

Host y credenciales

Las solicitudes OpenAI de pago por uso usan https://api.xiaomimimo.com/v1 y el encabezado api-key. Token Plan usa su host y credencial tp-xxxxx.

02

Modelo y cuerpo

El ejemplo oficial usa mimo-v2.5-pro y /chat/completions. Valida messages antes de cambiar muestreo o campos de agentes.

03

El razonamiento tiene estado

El pensamiento profundo devuelve reasoning_content. En llamadas de herramientas de varios turnos, Xiaomi pide reenviar el campo completo o la API puede devolver 400.

SOLICITUD MÍNIMA

Empieza con curl antes de ajustar el SDK

Esta es la forma compatible con OpenAI de la documentación, reducida a los campos que confirman la ruta. Guarda la clave en una variable de entorno.

BASE COPIABLE

curl --location --request POST 'https://api.xiaomimimo.com/v1/chat/completions' \
--header "api-key: $MIMO_API_KEY" \
--header "Content-Type: application/json" \
--data-raw '{"model":"mimo-v2.5-pro","messages":[{"role":"user","content":"Hello"}],"max_completion_tokens":1024,"stream":false}'

El ejemplo oficial también muestra max_completion_tokens, temperature 1.0, top_p 0.95, stream false y campos de penalización. El pensamiento profundo puede imponer los valores recomendados.

  1. 01

    Elige la ruta de cuenta

    Para pago por uso, usa https://api.xiaomimimo.com/v1. Para Token Plan, sustituye el host por el Base URL exclusivo de tu suscripción.

  2. 02

    Envía la autenticación de Xiaomi

    Usa api-key: $MIMO_API_KEY y Content-Type: application/json. No supongas que todos los clientes OpenAI traducen Authorization al encabezado documentado.

  3. 03

    Usa el ID exacto

    Configura model como mimo-v2.5-pro. Un gateway puede publicar otro slug, así que copia el ID actual de su catálogo.

  4. 04

    Envía un turno de usuario

    Comienza con un solo mensaje user. Añade tools, thinking y stream después de recibir una completion válida.

PENSAMIENTO, STREAMING Y CONTEXTO

Tres controles que cambian la respuesta

Usa el comportamiento de la API como prueba. Una respuesta final vacía puede ocurrir porque el cliente solo lee content, mientras el texto está en reasoning_content, o porque el pensamiento consumió el presupuesto.

01

thinking.type

Envía {"type":"enabled"} o {"type":"disabled"}. Xiaomi indica que mimo-v2.5-pro y mimo-v2.5 vienen activados. En el SDK de Python, coloca este campo no estándar en extra_body.

02

stream y finalización

Con streaming, llegan primero los fragmentos reasoning_content y después los de content. Acumula ambos, detente en finish_reason y procesa el fragmento usage antes de [DONE].

03

Contexto y presupuesto

No inventes un número de ventana de contexto que no esté documentado. Mantén messages dentro del límite actual del modelo y la cuenta. max_completion_tokens cubre pensamiento y respuesta final.

Xiaomi indica que temperature y top_p personalizados no son efectivos en pensamiento profundo. Sus valores recomendados son 1.0 y 0.95. Comprueba la respuesta real del servidor.

DIFERENCIAS DE RUTA

La API oficial, Token Plan y los gateways no comparten todo

La compatibilidad con OpenAI describe el estilo de solicitud, no la facturación, los alias, los encabezados, las cuotas, la moderación o el streaming. Guarda el host y proveedor con cada fallo.

ComprobaciónXiaomi oficialGateway o proveedor
Base OpenAIhttps://api.xiaomimimo.com/v1Usa el Base URL actual del proveedor
Token Planhttps://token-plan-cn.xiaomimimo.com/v1 con tp-xxxxxNormalmente no se intercambia con una clave de pago por uso
Campo modelmimo-v2.5-proCopia el slug exacto del catálogo
Authapi-key: MIMO_API_KEYSigue el encabezado y formato de clave del proveedor
Límites y políticaRevisa uso y consola de XiaomiRevisa cuota, moderación, RPM, TPM y concurrencia

LISTA DE CÓDIGOS

Usa el código para acotar la búsqueda

Cambia una sola variable cada vez. Guarda host, modelo, cuerpo de respuesta y hora antes de repetir.

400

Cuerpo mal formado, campo no compatible, messages inválido o historial de herramientas sin reasoning_content.

Repite la solicitud mínima y revisa JSON, model, messages, posición de thinking y reenvío completo de reasoning_content.

401

Clave ausente, caducada, con prefijo incorrecto o enviada en otro encabezado.

Carga la clave desde una variable de entorno y usa api-key. Nunca imprimas el secreto.

403

La cuenta o ruta no tiene permiso, o una política del gateway rechazó la solicitud.

Confirma cuenta, host del plan, acceso al modelo, política del proveedor y moderación.

404

La ruta del host o el alias del modelo no existe.

Comprueba /v1/chat/completions, el Base URL y el catálogo actual. No añadas /v1 dos veces.

429

Se superó el límite de velocidad, tokens, concurrencia o cuota.

Revisa los límites activos, aplica backoff con jitter y reduce llamadas paralelas.

EMPTY

La solicitud termina sin content o el stream parece detenido.

Registra cada delta, reasoning_content y finish_reason. Aumenta max_completion_tokens, revisa el parser y prueba thinking disabled.

UNA RUTA DE NAVEGADOR SIN API

Usa Tabbit para trabajar con la página, no con credenciales

El selector actual de Tabbit no muestra MiMo-V2.5-Pro. No hay una integración de un clic que podamos prometer. Para investigar páginas o comparar respuestas, elige un modelo que sí figure en Tabbit y separa ese flujo del diagnóstico de API.

Selector de modelos de Tabbit con modelos GPT, Gemini y Claude visibles.
01

Elige un modelo listado

El selector de la nueva pestaña muestra los modelos disponibles. No necesitas crear una clave Xiaomi ni copiar un Base URL.

Chat de Tabbit con cinco respuestas de modelos compatibles lado a lado.
02

Aporta el contexto web

Pregunta sobre la página actual o referencia páginas y archivos desde el navegador. Es un problema distinto de enviar una solicitud cruda.

Vista Deep Research de Tabbit con resultados de Google y una barra de pasos.
03

Compara respuestas

Tabbit puede mostrar respuestas de modelos compatibles lado a lado y usar Deep Research para reunir fuentes y pasos.

QUÉ RUTA ELEGIR

Control de API frente a contexto del navegador

MiMo a través de Xiaomi sirve cuando controlas la integración. Tabbit es más directo cuando quieres trabajar con páginas usando un modelo compatible.

NecesidadMiMo APITabbit
CredencialesCrear y proteger una clave Xiaomi o del proveedorUsar los modelos del selector
ControlElegir host, modelo, cuerpo, pensamiento, herramientas y streamPreguntar desde el contexto del navegador
Estado de herramientasConservar reasoning_content del assistantNo repetir mensajes de API manualmente
Investigación webConstruir búsqueda, fetch y citasUsar páginas y el flujo Deep Research

FAQ DE MIMO API

Lo que suele aparecer después del primer fallo

¿Cuál es el endpoint oficial de MiMo 2.5 Pro?+

Para compatibilidad OpenAI de pago por uso, Xiaomi documenta https://api.xiaomimimo.com/v1 y la ruta /chat/completions. Token Plan tiene otro Base URL.

¿Qué encabezado de API Key documenta Xiaomi?+

El curl oficial usa api-key: $MIMO_API_KEY. Guarda la clave en una variable de entorno y confirma si un gateway pide otro encabezado.

¿Qué ID de modelo debo enviar?+

El ejemplo de Xiaomi usa mimo-v2.5-pro. Un gateway puede publicar otro alias, así que usa su ID exacto.

¿Cómo activo o desactivo el pensamiento profundo?+

Envía thinking.type como enabled o disabled. En el SDK Python usa extra_body. Xiaomi indica que ambos modelos V2.5 vienen activados.

¿Por qué la respuesta está vacía o tarda?+

El pensamiento consume presupuesto y añade latencia. En streaming, reasoning_content llega antes que content. Acumula ambos y revisa finish_reason.

¿Por qué una llamada de herramienta posterior devuelve 400?+

Con pensamiento y herramientas, Xiaomi pide reenviar el reasoning_content completo en el mensaje assistant siguiente. Si falta, el contexto queda incompleto.

¿Tiene MiMo una ventana de contexto fija que pueda copiar?+

No copies un número no confirmado de una página de terceros. Revisa los límites actuales del modelo y la cuenta y deja espacio para pensamiento y respuesta.

¿Puedo usar MiMo-V2.5-Pro directamente en Tabbit?+

El selector actual de Tabbit no lo muestra. Usa Xiaomi o un gateway para la API, o un modelo listado en Tabbit para investigación web.

¿Listo para dejar de adivinar el próximo 400?

Repite la solicitud mínima de Xiaomi y añade thinking, tools y streaming uno por uno. Para trabajar con páginas, usa un modelo compatible de Tabbit sin crear una clave API.

La disponibilidad y los límites pueden cambiar. Revisa la documentación oficial antes de publicar.

© 2026 Tabbit Browser. El navegador nativo de IA que entiende tu contexto.