AMD 入局免费大模型!Radeon Cloud Token Factory 免费开放 4 大旗舰模型 API,原生双协议,OpenCode 已经集成
继英伟达 NVIDIA NIM 之后,全球芯片巨头 AMD 也正式亮出开发者大模型底牌。AMD 官方开发者平台近期低调上线 Radeon Cloud Token Factory,面向全球开发者免费开放 4 款主流 AI 模型 API,包含具备 100 万超长上下文的 DeepSeek-V4-Flash、DeepSeek-V4-Flash-Vision-Exp 视觉版,以及阿里 Qwen 3.8 Flash Next 和面壁智能 MiniCPM 5 1B。
更让开发者振奋的是实际可用性。许多开发者测试英伟达 NIM 时常遭遇严苛的 429 限流甚至服务中断,而 AMD 展现了极高的工程诚意,免绑卡免充值,实测响应迅速且稳定性出众。同时 AMD 罕见地原生兼容 OpenAI 与 Anthropic 双协议,目前 OpenCode 已经深度集成,直接添加 Key 即可秒级开工。
💡 核心速览
- 🎁 核心福利:AMD Radeon Cloud 官方公用免费 API,零门槛免充值即可调用。
- 🤖 首发 4 大旗舰模型:
- DeepSeek-V4-Flash:284B MoE 架构,原生 100 万 Token 上下文,主打极速代码编写与深度逻辑推理。
- DeepSeek-V4-Flash-Vision-Exp:100 万 Token 上下文实验性多模态视觉模型,支持图表解析与设计稿审查。
- Qwen 3.8 Flash Next:256K 上下文,阿里通义千问最新高速推理版本。
- MiniCPM 5 1B:128K 上下文,面壁智能 1B 极致轻量模型,首字延迟极低,适合高频自动化流水线。
- ⚡ 原生双协议支持:一套 Key 同时支持 OpenAI 与 Anthropic 两种消息标准,无需额外代理转换。
- 🚀 生态集成:OpenCode 直接填入 Key 即可流畅使用。ZCode 暂不支持该接口。
- 💳 使用门槛:免绑信用卡,免海外手机号,支持国内手机号或邮箱直接注册。
- 🔗 控制台入口:AMD Radeon Cloud Token Factory 控制台
🚀 一、实测良心高可用:AMD 算力生态诚意解析
过去一年中,英伟达通过 NIM 吸引了大量关注,但免费端点频繁遭遇 429 速率限制与排队延迟,日常开发容易受阻。
AMD 在 Radeon Cloud 推出的 Token Factory 则表现出截然不同的可用度:
!AMD Radeon Cloud Token Factory 模型网关大厅
- 真实可用,吞吐流畅:在多轮压力测试与日常补全调用中,AMD 端点首字生成延迟低,上下文流式吞吐平稳,真正具备作为日常主力工具的素质。
- 完整开放 100 万 Token 上下文:DeepSeek V4 Flash 与 Vision 版均提供完整的 1,048,576 Tokens 上下文窗口,单次请求即可吞入整个工程的源码仓库或高分辨率设计图。
- 透明计费说明:官方计费字段明确标注免费使用,返回的 Points 仅作为相对使用量统计,不产生任何真实账单。
🛠️ 二、极速上手:从获取 Key 到接入 OpenCode
详细注册流程与完整截图可参阅专有指南: 👉 《AMD Radeon Cloud API 密钥获取与接入指南》
全程约 1 分钟即可完成配置:
第一步:登录 AMD 开发者平台
访问官方入口 https://developer.amd.com.cn/radeon/tokenfactory,右上角点击登录,支持手机验证码或邮箱注册登录,无需资质审核。
第二步:获取专属 API Key
登录后在 Token Factory 页面点击任意免费模型卡片,例如 DeepSeek-V4-Flash-0731。
在弹窗中点击 API Key 右侧的复制按钮,即可复制 sk- 开头的专属密钥。
第三步:直接接入 OpenCode
OpenCode 已原生支持 AMD Radeon Cloud,无需配置中间网关:
- 打开 OpenCode 设置面板中的模型或提供商管理;
- Base URL 填写:
https://developer.amd.com.cn/radeon/api/v1; - 填入复制的 API Key,模型指定为
DeepSeek-V4-Flash或Qwen3.8-Flash-Next即可直接使用。
特别提示:社区多位开发者实测发现,ZCode 暂无法适配该端点,会出现请求握手异常,推荐直接使用已经完成集成的 OpenCode。
⚡ 三、原生支持 Anthropic Claude 格式
通常针对只支持 Anthropic 协议的工具,开发者需要搭建格式转换中间件。AMD Radeon Cloud 从底层直接兼容了 Anthropic 消息协议,在控制台切换至 Anthropic 标签页即可查看官方说明:
1. OpenAI 格式调用示例
curl https://developer.amd.com.cn/radeon/api/v1/chat/completions \
-H "Authorization: Bearer $AMD_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "DeepSeek-V4-Flash",
"messages": [
{"role": "user", "content": "请用 TypeScript 编写一个高效的防抖节流装饰器"}
]
}'2. Anthropic 格式调用示例
curl https://developer.amd.com.cn/radeon/api/v1/messages \
-H "x-api-key: $AMD_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{
"model": "DeepSeek-V4-Flash",
"max_tokens": 1024,
"messages": [
{"role": "user", "content": "Hello Anthropic format!"}
]
}'3. Python SDK 调用示例
from openai import OpenAI
client = OpenAI(
base_url="https://developer.amd.com.cn/radeon/api/v1",
api_key="YOUR_AMD_API_KEY",
)
response = client.chat.completions.create(
model="DeepSeek-V4-Flash",
messages=[{"role": "user", "content": "请总结微内核架构的优缺点"}],
)
print(response.choices[0].message.content)⚠️ 四、开发者实用避坑指南
- 认准 4 款公用免费模型:当前免费端点为 DeepSeek-V4-Flash-0731、DeepSeek-V4-Flash-Vision-Exp、Qwen3.8-Flash-Next 与 MiniCPM5-1B。
- 算力搭配建议:免费公用端点适合日常开发与轻量测试。对于企业级高并发或严格 SLA 需求,可搭配商业订阅方案,例如 OpenCode Go:👉 https://opencode.ai/go?ref=SVE58K5K80。
📬 关注 Free AI API 免费算力雷达
Free AI API 实时追踪全球优质大模型的 0 元 API、限时免费活动与降价动态。欢迎订阅免费邮件周刊 Newsletter,第一时间获取最新算力资讯!

社区反馈
评论与你的 GitHub 账号绑定,登录后即可参与讨论。