AMD 官宣入局免费大模型!Radeon Cloud Token Factory 免费开放 5 大旗舰模型 API,原生双协议直连 Cursor/Cline

AMD Radeon Cloud Token Factory 免费开放 5 大旗舰模型 API 封面

AMD 官宣入局免费大模型!Radeon Cloud Token Factory 免费开放 5 大旗舰模型 API,原生双协议直连 Cursor/Cline

继英伟达(NVIDIA NIM)之后,全球芯片巨头 AMD 也正式亮出了自己的开发者大模型底牌!AMD 官方开发者平台(AMD Developer China)近期低调上线了 Radeon Cloud Token Factory(令牌工场),直接面向所有开发者免费开放 5 款重磅主流 AI 模型 API,包含具备 100 万超长上下文的 DeepSeek-V4-FlashDeepSeek-V4-Flash-Vision-Exp 多模态视觉版,以及阿里 Qwen 3.8 Flash Next、面壁智能 MiniCPM-V 4.6 等。

更让开发者惊喜的是:AMD 提供了极度罕见的原生双协议兼容,同一个 API 端点与密钥,既能走标准 OpenAI 格式,也能走 Anthropic Claude 格式,无需任何中间网关中转即可无缝接入各大主流 AI 编程助手与 Agent 工作流!


💡 核心速览 (Key Highlights)

  • 🎁 核心福利:AMD Radeon Cloud 官方公用免费 API(Public Free Model APIs),零门槛免费免充值调用。
  • 🤖 首发阵容:覆盖 5 大顶尖模型:
    • DeepSeek-V4-Flash(284B MoE 极速代码推理,100 万 Token 原生超长上下文)
    • DeepSeek-V4-Flash-Vision-Exp(100 万 Token 上下文实验性全模态视觉大模型)
    • Qwen 3.8 Flash Next(256K 上下文,通义千问极速逻辑推演旗舰)
    • MiniCPM-V 4.6(256K 上下文,面壁智能端侧多模态图像/OCR 旗舰)
    • MiniCPM 5 1B(128K 上下文,1B 极致轻量超高吞吐语言模型)
  • 神级特性OpenAI + Anthropic 双协议原生支持!Cursor、Cline、Roo Code、Aider 等工具可直接把 AMD 端点当作 Claude 或 OpenAI 挂载。
  • 💳 门槛要求免绑信用卡、免海外手机号!国内开发者支持手机号/邮箱直接注册登录。
  • 🔗 直达体验AMD Radeon Cloud Token Factory 控制台

🚀 一、AMD 为什么也来送算力?Token Factory 算力解析

过去一年,NVIDIA 凭借 NIM 开发者计划吸引了数百万全球开发者体验其 GPU 算力栈。而 AMD 作为全球第二大算力芯片巨头,近年来在 ROCm 软件生态、vLLM 与 sglang 深度适配上持续发力。

此次在 Radeon Cloud 上推出的 Token Factory,正是 AMD 展现其 Instinct 与 Radeon GPU 算力集群推理性能的核心舞台:

!AMD Radeon Cloud Token Factory 模型网关大厅

1. 为什么选择 AMD Token Factory?

  1. Dynamic sglang-router 与 vLLM 极速调度:官方针对 DeepSeek V4 Flash 与 Qwen 3.8 专门配置了基于 AMD ROCm 7.x 的自适应推理路由器,首字响应时间(TTFT)处于极佳水平。
  2. 100 万 Token 原生超长上下文毫不缩水:DeepSeek V4 Flash 与 Vision 均开放了整整 1,048,576 Tokens(1M)的完整上下文窗口,单次请求能吞入整座项目的源代码或数十张高分辨率设计图。
  3. 免费使用依据(Rethinking Free):在官方接口计费字段中明确标注 "Free to use. Points show relative usage—not a charge."(免费使用,点数仅用于统计相对消耗比例,不收取任何真实费用)。

🛠️ 二、极速上手指南:从获取 Key 到接入主流 IDE

AMD Token Factory 的获取流程非常顺畅,全程只需约 1 分钟:

第一步:登录 AMD 开发者平台

访问官方入口:👉 https://developer.amd.com.cn/radeon/tokenfactory 右上角点击登录,支持国内手机验证码或邮箱注册登录,无需任何繁琐资质审核。

第二步:获取专属 API Key

登录后,在 Token Factory (BETA) 页面任意点击一款免费模型(如 DeepSeek-V4-Flash-0731):

!AMD 模型详情与 API Key 弹窗

在弹出的详情窗口中,点击 API Key 一栏右侧的复制按钮即可复制你的专属密钥(形式如 sk-...)。

第三步:填入 Cursor / Cline / Roo Code 等工具

AMD 提供的接口参数如下:

  • Base URL: https://developer.amd.com.cn/radeon/api/v1
  • API Key: 填入你在 AMD 控制台复制的密钥
  • 模型名称: DeepSeek-V4-FlashQwen3.8-Flash-Next

1. Cursor 配置

  • 打开 Cursor Settings -> Models
  • 勾选或添加模型名称:DeepSeek-V4-Flash
  • 打开 OpenAI API Key 设置项,开启 Override OpenAI Base URL
  • 将 URL 改为:https://developer.amd.com.cn/radeon/api/v1,填入 API Key 即可!

2. Cline / Roo Code / Windsurf 配置

在提供商选项中选择 OpenAI Compatible

  • Base URL: https://developer.amd.com.cn/radeon/api/v1
  • API Key: $AMD_API_KEY
  • Model ID: DeepSeek-V4-Flash(或 DeepSeek-V4-Flash-Vision-Exp

⚡ 三、罕见的双协议兼容:原生支持 Anthropic Claude 格式

通常第三方的 OpenAI 兼容中转服务,如果遇到只支持 Anthropic 协议的工具(例如某些只认 x-api-key/v1/messages 的 Claude 专属工作流)往往需要架设额外代理转换。

而 AMD Radeon Cloud 在底层直接原生支持了 Anthropic 消息协议!在控制台弹窗中切换到 Anthropic Tab 即可看到官方支持说明:

!AMD 原生支持 Anthropic 协议调用

1. OpenAI 格式调用验证(cURL)

bash
curl https://developer.amd.com.cn/radeon/api/v1/chat/completions \
  -H "Authorization: Bearer $AMD_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "DeepSeek-V4-Flash",
    "messages": [
      {"role": "user", "content": "请用 TypeScript 编写一个高效的防抖节流装饰器"}
    ]
  }'

2. Anthropic 格式调用验证(cURL)

bash
curl https://developer.amd.com.cn/radeon/api/v1/messages \
  -H "x-api-key: $AMD_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "DeepSeek-V4-Flash",
    "max_tokens": 1024,
    "messages": [
      {"role": "user", "content": "Hello Anthropic format!"}
    ]
  }'

3. Python 官方 SDK 一行接入

python
from openai import OpenAI

client = OpenAI(
    base_url="https://developer.amd.com.cn/radeon/api/v1",
    api_key="YOUR_AMD_API_KEY",
)

response = client.chat.completions.create(
    model="DeepSeek-V4-Flash",
    messages=[{"role": "user", "content": "请总结微内核架构的优缺点"}],
)

print(response.choices[0].message.content)

⚠️ 四、开发者实用避坑指南

  1. 服务偶发维护与备用路由:作为公测阶段的公用免费端点(Public Free Model APIs),部分模型(如 MiniCPM-V46)可能会因 AMD 后台集群维护而短暂标记为 Temp Offline。建议在主力编码场景中搭配双提供商路由。
  2. 点数并非扣费账单:调用返回或控制台看到的 Points 仅为消耗量度量衡,当前账户无需充值,可放心测试。
  3. 日常多渠道主力口粮储备:免费公用 API 非常适合用于开发测试、冷启动或日常轻量补全。如果需要极高并发保障或商业级 SLA,也可以考虑搭配订阅制方案(例如 OpenCode Go 首月特惠仅 $5,享每月高额配额池与专属高速路由:👉 https://opencode.ai/go?ref=SVE58K5K80)。

📬 关注 Free AI API 免费算力雷达

Free AI API 实时追踪全球优质大模型的 0 元 API、限时免费活动与降价动态。欢迎订阅我们的免费邮件周刊(Newsletter),或将本站加入书签,第一时间获取全球最新算力羊毛!

社区反馈

评论与你的 GitHub 账号绑定,登录后即可参与讨论。