MiniMax M3 (GMI Cloud)
GMI Cloud 官方提供的 MiniMax M3 推理端点。限时 14 天 100% 全量免费,支持 1M MSA 稀疏注意力与 OpenAI 协议直连。
更新于 2026/8/252 个代码示例
关于该模型
为什么要选择 MiniMax M3?
MiniMax M3 是 MiniMax 旗下的顶级全栈代码与推理模型,专为长程自主 Agent、超大工程重构与复杂逻辑攻坚打造。在 2026 年权威评测 SWE-bench Pro 中获得 59.0% 解决率,紧咬 Kimi K3 并领先 DeepSeek V4。
核心优势与特点
- 100 万 Token(1M MSA)稀疏注意力:一次性完整吞吐数十万行复杂代码工程或海量技术文档,延迟与计算开销极低。
- 顶尖端到端编程与 Agent 规划:原生强化工具调用与多步自我纠错逻辑,Terminal-Bench 2.1 获得 66.0% 高分。
- 原生多模态分析:支持图像与 UI 录屏排障分析,能精准识别架构图与界面异常并生成修复代码。
- 限时 14 天 100% 免费:在 GMI Cloud MiniMax Week 期间 0 元直接调用,无需绑定信用卡,无需预充值。
如何免费接入 (通过 GMI Cloud)
免费依据与活动说明
2026 年 8 月 24 日至 9 月 6 日,GMI Cloud 与 MiniMax 官方联合开展「MiniMax Week」限时免费活动。在活动期间调用 minimax-m3 完全 0 费用,不扣除任何余额,无需绑定信用卡,无需预充值。
全链路与 IDE 接入
支持标准 OpenAI 兼容协议。可在 Cursor、Claude Code、Trae、OpenCode 等工具中直接配置 Base URL 为 https://api.gmi-serving.com/v1 并填入 API Key 即可使用。
在浏览器里试用
选个模型、粘贴你自己的免费 Key,即可运行。你的 Key 只用于调用一次该提供商,绝不存储在我们的服务器上。
选个模型、粘贴你自己的免费 Key,即可运行。你的 Key 只用于调用一次该提供商,绝不存储在我们的服务器上。
调用代码示例
curl
curl https://api.gmi-serving.com/v1/chat/completions \
-H "Authorization: Bearer $GMI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "minimax-m3",
"messages": [
{"role": "user", "content": "请分析基于分布式 Raft 协议的选主逻辑并给出优化方案。"}
],
"temperature": 0.2
}'python
from openai import OpenAI
import os
client = OpenAI(
base_url="https://api.gmi-serving.com/v1",
api_key=os.environ.get("GMI_API_KEY"),
)
response = client.chat.completions.create(
model="minimax-m3",
messages=[
{"role": "system", "content": "You are an expert full-stack engineer."},
{"role": "user", "content": "请分析工程架构瓶颈并生成重构后的 TypeScript 代码。"}
],
temperature=0.3,
stream=True,
)
for chunk in response:
content = chunk.choices[0].delta.content
if content:
print(content, end="", flush=True)
社区反馈
评论与你的 GitHub 账号绑定,登录后即可参与讨论。