AMD 官宣入局免费大模型!Radeon Cloud Token Factory 免费开放 5 大旗舰模型 API,原生双协议直连 Cursor/Cline
继英伟达(NVIDIA NIM)之后,全球芯片巨头 AMD 也正式亮出了自己的开发者大模型底牌!AMD 官方开发者平台(AMD Developer China)近期低调上线了 Radeon Cloud Token Factory(令牌工场),直接面向所有开发者免费开放 5 款重磅主流 AI 模型 API,包含具备 100 万超长上下文的 DeepSeek-V4-Flash、DeepSeek-V4-Flash-Vision-Exp 多模态视觉版,以及阿里 Qwen 3.8 Flash Next、面壁智能 MiniCPM-V 4.6 等。
更让开发者惊喜的是:AMD 提供了极度罕见的原生双协议兼容,同一个 API 端点与密钥,既能走标准 OpenAI 格式,也能走 Anthropic Claude 格式,无需任何中间网关中转即可无缝接入各大主流 AI 编程助手与 Agent 工作流!
💡 核心速览 (Key Highlights)
- 🎁 核心福利:AMD Radeon Cloud 官方公用免费 API(Public Free Model APIs),零门槛免费免充值调用。
- 🤖 首发阵容:覆盖 5 大顶尖模型:
- DeepSeek-V4-Flash(284B MoE 极速代码推理,100 万 Token 原生超长上下文)
- DeepSeek-V4-Flash-Vision-Exp(100 万 Token 上下文实验性全模态视觉大模型)
- Qwen 3.8 Flash Next(256K 上下文,通义千问极速逻辑推演旗舰)
- MiniCPM-V 4.6(256K 上下文,面壁智能端侧多模态图像/OCR 旗舰)
- MiniCPM 5 1B(128K 上下文,1B 极致轻量超高吞吐语言模型)
- ⚡ 神级特性:OpenAI + Anthropic 双协议原生支持!Cursor、Cline、Roo Code、Aider 等工具可直接把 AMD 端点当作 Claude 或 OpenAI 挂载。
- 💳 门槛要求:免绑信用卡、免海外手机号!国内开发者支持手机号/邮箱直接注册登录。
- 🔗 直达体验:AMD Radeon Cloud Token Factory 控制台
🚀 一、AMD 为什么也来送算力?Token Factory 算力解析
过去一年,NVIDIA 凭借 NIM 开发者计划吸引了数百万全球开发者体验其 GPU 算力栈。而 AMD 作为全球第二大算力芯片巨头,近年来在 ROCm 软件生态、vLLM 与 sglang 深度适配上持续发力。
此次在 Radeon Cloud 上推出的 Token Factory,正是 AMD 展现其 Instinct 与 Radeon GPU 算力集群推理性能的核心舞台:
!AMD Radeon Cloud Token Factory 模型网关大厅
1. 为什么选择 AMD Token Factory?
- Dynamic sglang-router 与 vLLM 极速调度:官方针对 DeepSeek V4 Flash 与 Qwen 3.8 专门配置了基于 AMD ROCm 7.x 的自适应推理路由器,首字响应时间(TTFT)处于极佳水平。
- 100 万 Token 原生超长上下文毫不缩水:DeepSeek V4 Flash 与 Vision 均开放了整整 1,048,576 Tokens(1M)的完整上下文窗口,单次请求能吞入整座项目的源代码或数十张高分辨率设计图。
- 免费使用依据(Rethinking Free):在官方接口计费字段中明确标注 "Free to use. Points show relative usage—not a charge."(免费使用,点数仅用于统计相对消耗比例,不收取任何真实费用)。
🛠️ 二、极速上手指南:从获取 Key 到接入主流 IDE
AMD Token Factory 的获取流程非常顺畅,全程只需约 1 分钟:
第一步:登录 AMD 开发者平台
访问官方入口:👉 https://developer.amd.com.cn/radeon/tokenfactory 右上角点击登录,支持国内手机验证码或邮箱注册登录,无需任何繁琐资质审核。
第二步:获取专属 API Key
登录后,在 Token Factory (BETA) 页面任意点击一款免费模型(如 DeepSeek-V4-Flash-0731):
在弹出的详情窗口中,点击 API Key 一栏右侧的复制按钮即可复制你的专属密钥(形式如 sk-...)。
第三步:填入 Cursor / Cline / Roo Code 等工具
AMD 提供的接口参数如下:
- Base URL:
https://developer.amd.com.cn/radeon/api/v1 - API Key: 填入你在 AMD 控制台复制的密钥
- 模型名称:
DeepSeek-V4-Flash或Qwen3.8-Flash-Next
1. Cursor 配置
- 打开 Cursor Settings -> Models;
- 勾选或添加模型名称:
DeepSeek-V4-Flash; - 打开 OpenAI API Key 设置项,开启 Override OpenAI Base URL;
- 将 URL 改为:
https://developer.amd.com.cn/radeon/api/v1,填入 API Key 即可!
2. Cline / Roo Code / Windsurf 配置
在提供商选项中选择 OpenAI Compatible:
- Base URL:
https://developer.amd.com.cn/radeon/api/v1 - API Key:
$AMD_API_KEY - Model ID:
DeepSeek-V4-Flash(或DeepSeek-V4-Flash-Vision-Exp)
⚡ 三、罕见的双协议兼容:原生支持 Anthropic Claude 格式
通常第三方的 OpenAI 兼容中转服务,如果遇到只支持 Anthropic 协议的工具(例如某些只认 x-api-key 和 /v1/messages 的 Claude 专属工作流)往往需要架设额外代理转换。
而 AMD Radeon Cloud 在底层直接原生支持了 Anthropic 消息协议!在控制台弹窗中切换到 Anthropic Tab 即可看到官方支持说明:
1. OpenAI 格式调用验证(cURL)
curl https://developer.amd.com.cn/radeon/api/v1/chat/completions \
-H "Authorization: Bearer $AMD_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "DeepSeek-V4-Flash",
"messages": [
{"role": "user", "content": "请用 TypeScript 编写一个高效的防抖节流装饰器"}
]
}'2. Anthropic 格式调用验证(cURL)
curl https://developer.amd.com.cn/radeon/api/v1/messages \
-H "x-api-key: $AMD_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{
"model": "DeepSeek-V4-Flash",
"max_tokens": 1024,
"messages": [
{"role": "user", "content": "Hello Anthropic format!"}
]
}'3. Python 官方 SDK 一行接入
from openai import OpenAI
client = OpenAI(
base_url="https://developer.amd.com.cn/radeon/api/v1",
api_key="YOUR_AMD_API_KEY",
)
response = client.chat.completions.create(
model="DeepSeek-V4-Flash",
messages=[{"role": "user", "content": "请总结微内核架构的优缺点"}],
)
print(response.choices[0].message.content)⚠️ 四、开发者实用避坑指南
- 服务偶发维护与备用路由:作为公测阶段的公用免费端点(Public Free Model APIs),部分模型(如 MiniCPM-V46)可能会因 AMD 后台集群维护而短暂标记为
Temp Offline。建议在主力编码场景中搭配双提供商路由。 - 点数并非扣费账单:调用返回或控制台看到的 Points 仅为消耗量度量衡,当前账户无需充值,可放心测试。
- 日常多渠道主力口粮储备:免费公用 API 非常适合用于开发测试、冷启动或日常轻量补全。如果需要极高并发保障或商业级 SLA,也可以考虑搭配订阅制方案(例如 OpenCode Go 首月特惠仅 $5,享每月高额配额池与专属高速路由:👉 https://opencode.ai/go?ref=SVE58K5K80)。
📬 关注 Free AI API 免费算力雷达
Free AI API 实时追踪全球优质大模型的 0 元 API、限时免费活动与降价动态。欢迎订阅我们的免费邮件周刊(Newsletter),或将本站加入书签,第一时间获取全球最新算力羊毛!

社区反馈
评论与你的 GitHub 账号绑定,登录后即可参与讨论。