Xiaomi Lança Modelos Omnimodais MiMo v2.6 Pro e Flash: Mais Desempenho pelo Mesmo Preço Acessível

Xiaomi MiMo v2.6 Pro & Flash Infográfico de Capa

Lançamento do Xiaomi MiMo-V2.6 Pro e Flash: Áudio Nativo sem STT e Preços Acessíveis

Em um momento crucial em que os modelos de fundação evoluem do texto para agentes multimodais autônomos, a Xiaomi lançou e disponibilizou em código aberto no dia 22 de setembro de 2026 a família de modelos Xiaomi MiMo-V2.6. A linha inclui o modelo principal MiMo-V2.6-Pro, o eficiente MiMo-V2.6-Flash e a versão MiMo-V2.6-Pro-UltraSpeed, com velocidade de geração até 20 vezes maior.

A série MiMo é amplamente utilizada por desenvolvedores e equipes independentes como uma opção sólida e econômica no dia a dia. Nesta versão, o MiMo-V2.6-Pro alcançou a pontuação de 46.32 no índice Artificial Analysis v4.3, liderando os modelos de código aberto à frente de Kimi K3 e Qwen 3.8 Max, equiparando-se ao Claude Opus 5 e GPT-5.6 Sol em diversos testes de agentes. O grande diferencial técnico é a capacidade nativa de receber áudio omnimodal, eliminando a necessidade de uma etapa externa de transcrição de voz para texto (STT). A Xiaomi manteve exatamente os mesmos preços da versão 2.5, disponibilizando a API simultaneamente na Xiaomi Open Platform, OpenRouter, OpenCode Go e no cliente MiMo Desktop.

💡 Destaques Principais

  • 🎙️ Áudio Nativo Omnimodal: Compreende fluxos de áudio de ponta a ponta sem transcrição externa STT, reduzindo a latência pela metade e preservando entonação, emoções e detalhes acústicos.
  • 💰 Preços Reduzidos Mantidos: Tarifas abaixo do DeepSeek v4.1 com gravação em cache gratuita por tempo limitado. Flash custa apenas $0.14 de entrada e $0.28 de saída por milhão de tokens ($0.0028 com acerto de cache); Pro custa $0.435 de entrada e $0.87 de saída ($0.0036 com acerto de cache).
  • 📦 Alta Cota no OpenCode Go: Fora de plataformas fechadas com restrições, o MiMo continua sendo o modelo mais generoso e estável em cotas para programação contínua.
  • 🧠 Código Avançado e Recursos de Agentes: Alto desempenho em benchmarks com novas aplicações práticas: evolução de Vibe Coding para Vibe World com modelagem 3D no Blender, controle de braços robóticos e provas matemáticas rigorosas em Lean 4.
  • 🚀 Lançamento Simultâneo em Várias Plataformas: Disponível desde o primeiro dia na Xiaomi Open Platform, OpenRouter, OpenCode Go, AI Studio e no aplicativo oficial MiMo Desktop 1.0, com pesos e código RL abertos no HuggingFace.
  • 🛠️ Integração Direta: Protocolo padrão compatível com OpenAI, conectando-se em minutos ao Cursor, Claude Code, Codex, Pi e ZCode.

🔥 1. Processamento Nativo de Áudio: Superando a Limitação do STT

A maioria das soluções de voz com IA opera em três etapas fragmentadas: áudio do microfone -> transcrição em serviço ASR/Whisper -> texto enviado ao LLM -> sintetizador TTS de voz.

Esse formato tradicional impõe barreiras no desenvolvimento prático:

  • Latência acumulada: a transmissão e transcrição consomem de 400 a 800 milissegundos antes do início da geração de texto;
  • Perda de nuances vocais: converter a voz em texto plano remove o tom, a ênfase e o contexto acústico do ambiente;
  • Custos duplicados e dependência de serviços: gerenciar duas APIs aumenta o risco de falhas operacionais e custos por minuto.

O MiMo 2.6 projeta o espectro sonoro diretamente em vetores de tokens em uma rede de atenção compartilhada com texto e visão. O áudio é enviado diretamente para a API e o modelo processa a resposta de ponta a ponta. Isso remove custos de transcrição e aprimora interações em suporte, programação por voz e assistentes inteligentes.

💰 2. Economia Operacional: Alta Inteligência com Custos Controlados

Para fluxos de desenvolvimento com consumo de dezenas de milhões de tokens por dia, a eficiência orçamentária é essencial. A Xiaomi preservou os valores da versão 2.5. Tabela oficial por milhão de tokens:

  • MiMo-V2.6-Flash: $0.14 de entrada e $0.28 de saída. Acertos em cache saem por $0.0028, um desconto de 98%. Em modo de inferência em lote (Batch), o custo cai para $0.07 de entrada e $0.14 de saída;
  • MiMo-V2.6-Pro: $0.435 de entrada e $0.87 de saída. Acertos em cache saem por $0.0036. Em modo Batch, custa $0.2175 de entrada e $0.435 de saída;
  • MiMo-V2.6-Pro-UltraSpeed: Focado em respostas imediatas com geração até 20 vezes mais rápida, custando $4.35 de entrada, $8.70 de saída e $0.036 com acerto de cache.

A gravação em cache está temporariamente isenta de taxas adicionais, barateando a análise de projetos e repositórios extensos. No OpenCode Go, o MiMo garante disponibilidade estável para desenvolvedores sem paradas por esgotamento de créditos.

💻 3. De Vibe Coding a Vibe World: Programação e Ambientes Tridimensionais

No benchmark de engenharia de software DeepSWE v1.1, o MiMo-V2.6-Pro obteve 71.9 pontos e o Flash 67.9. No MiMo Code Bench, o Pro alcançou 63.2.

Além dos testes formais, o modelo expande sua atuação para tarefas além da programação tradicional:

  • Modelagem 3D e Ambientes Interativos: A partir de texto ou imagens, orquestra subagentes para gerar scripts em Python para Blender, criando ativos tridimensionais utilizáveis;
  • Simulação Robótica: Processa imagens de múltiplas câmeras em tempo real para controlar o braço robótico Franka Panda em ações de montagem e separação de peças;
  • Demonstração Matemática Formal: Ajudou pesquisadores a estruturar mais de 6.000 linhas de código no Lean 4 para o Teorema do Caos de Li-Yorke, validadas pelo compilador sem lacunas.

🛠️ 4. Formas de Acesso e Exemplos Práticos

O MiMo 2.6 pode ser integrado por diferentes canais:

1. Conexão Direta na Xiaomi Open Platform (Recomendado)

Crie sua conta em https://platform.xiaomimimo.com?ref=Z7EJ2L informando o código de convite Z7EJ2L para receber créditos promocionais e limite ampliado. O Base URL padrão compatível com OpenAI é https://api.xiaomimimo.com/v1, com os modelos mimo-v2.6-pro ou mimo-v2.6-flash.

Exemplo cURL com Áudio Nativo:

bash
curl https://api.xiaomimimo.com/v1/chat/completions \
  -H "Authorization: Bearer $XIAOMI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "mimo-v2.6-pro",
    "messages": [
      {
        "role": "user",
        "content": [
          {"type": "text", "text": "Analise a fala deste usuário e determine o objetivo principal:"},
          {"type": "input_audio", "input_audio": {"data": "UklGRiQAAABXQVZFZm10IBAAAAABAAEA...", "format": "wav"}}
        ]
      }
    ]
  }'

Exemplo Rápido em Python:

python
import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ.get("XIAOMI_API_KEY"),
    base_url="https://api.xiaomimimo.com/v1",
)

response = client.chat.completions.create(
    model="mimo-v2.6-pro",
    messages=[
        {"role": "system", "content": "Você é um arquiteto de sistemas sênior."},
        {"role": "user", "content": "Implemente uma classe assíncrona de cache LRU com suporte a TTL em TypeScript, incluindo testes unitários."}
    ],
    temperature=0.3,
)
print(response.choices[0].message.content)

2. Outras Plataformas Disponíveis

  • OpenRouter: Base URL https://openrouter.ai/api/v1 com os modelos xiaomi/mimo-v2.6-pro e xiaomi/mimo-v2.6-flash;
  • OpenCode Go: Selecione o MiMo 2.6 Pro diretamente na lista de modelos para pacotes amplos de tokens;
  • MiMo Desktop: Baixe o cliente oficial 1.0 em https://mimo-ai.xiaomimimo.com/desktop/, com modo UltraSpeed integrado.

⚡ 5. Configuração nos Ambientes de Desenvolvimento

Compatível com ferramentas que suportam a API da OpenAI:

  • Cursor: Ajustes -> Models -> Adicionar OpenAI Key -> Ativar Override Base URL com https://api.xiaomimimo.com/v1 -> Incluir modelo mimo-v2.6-pro;
  • Claude Code: Configure no terminal export ANTHROPIC_BASE_URL="https://api.xiaomimimo.com/v1", export ANTHROPIC_API_KEY="$XIAOMI_API_KEY", export CLAUDE_CODE_MODEL="mimo-v2.6-pro" e execute claude;
  • Codex CLI: Defina OPENAI_API_BASE="https://api.xiaomimimo.com/v1", OPENAI_API_KEY="$XIAOMI_API_KEY", CODEX_MODEL_NAME="mimo-v2.6-pro";
  • Pi e ZCode: Selecione provedor compatível com OpenAI, insira a URL base e a chave, e escolha mimo-v2.6-pro.

⚠️ 6. Recomendações e Boas Práticas

  • Mantenha Prefixos Fixos para Aproveitar o Cache: Com contexto de 1M e desconto de 98% em leituras de cache, posicione regras do sistema e esquemas no início do prompt;
  • Prefira o Envio de Áudio Nativo: Evite transcrever localmente áudios de baixa qualidade com modelos reduzidos. O envio direto garante maior precisão contextual;
  • Isole Sessões Longas de Depuração: Em tarefas extensas com excesso de logs, crie sessões novas para cada objetivo pontual, preservando a coerência e reduzindo custos.

📬 7. Explore o Desenvolvimento Omnimodal

O Xiaomi MiMo 2.6 une capacidade analítica avançada e custo sustentável, tornando acessível a criação de fluxos multimodais inteligentes.

Acompanhe o FreeAIAPI.org para descobrir APIs gratuitas e novidades sobre modelos de código aberto. Assine nossa Newsletter para receber avisos sobre novas ferramentas e reduções de preço.

Feedback da comunidade

Os comentários estão vinculados à sua conta GitHub — entre para participar da discussão.