AMD 入局免费大模型!Radeon Cloud Token Factory 免费开放 4 大旗舰模型 API,原生双协议,OpenCode 已经集成

AMD Radeon Cloud Token Factory 免费开放 4 大旗舰模型 API 封面

AMD 入局免费大模型!Radeon Cloud Token Factory 免费开放 4 大旗舰模型 API,原生双协议,OpenCode 已经集成

继英伟达 NVIDIA NIM 之后,全球芯片巨头 AMD 也正式亮出开发者大模型底牌。AMD 官方开发者平台近期低调上线 Radeon Cloud Token Factory,面向全球开发者免费开放 4 款主流 AI 模型 API,包含具备 100 万超长上下文的 DeepSeek-V4-Flash、DeepSeek-V4-Flash-Vision-Exp 视觉版,以及阿里 Qwen 3.8 Flash Next 和面壁智能 MiniCPM 5 1B。

更让开发者振奋的是实际可用性。许多开发者测试英伟达 NIM 时常遭遇严苛的 429 限流甚至服务中断,而 AMD 展现了极高的工程诚意,免绑卡免充值,实测响应迅速且稳定性出众。同时 AMD 罕见地原生兼容 OpenAI 与 Anthropic 双协议,目前 OpenCode 已经深度集成,直接添加 Key 即可秒级开工。

💡 核心速览

  • 🎁 核心福利:AMD Radeon Cloud 官方公用免费 API,零门槛免充值即可调用。
  • 🤖 首发 4 大旗舰模型
    • DeepSeek-V4-Flash:284B MoE 架构,原生 100 万 Token 上下文,主打极速代码编写与深度逻辑推理。
    • DeepSeek-V4-Flash-Vision-Exp:100 万 Token 上下文实验性多模态视觉模型,支持图表解析与设计稿审查。
    • Qwen 3.8 Flash Next:256K 上下文,阿里通义千问最新高速推理版本。
    • MiniCPM 5 1B:128K 上下文,面壁智能 1B 极致轻量模型,首字延迟极低,适合高频自动化流水线。
  • 原生双协议支持:一套 Key 同时支持 OpenAI 与 Anthropic 两种消息标准,无需额外代理转换。
  • 🚀 生态集成:OpenCode 直接填入 Key 即可流畅使用。ZCode 暂不支持该接口。
  • 💳 使用门槛:免绑信用卡,免海外手机号,支持国内手机号或邮箱直接注册。
  • 🔗 控制台入口AMD Radeon Cloud Token Factory 控制台

🚀 一、实测良心高可用:AMD 算力生态诚意解析

过去一年中,英伟达通过 NIM 吸引了大量关注,但免费端点频繁遭遇 429 速率限制与排队延迟,日常开发容易受阻。

AMD 在 Radeon Cloud 推出的 Token Factory 则表现出截然不同的可用度:

!AMD Radeon Cloud Token Factory 模型网关大厅

  1. 真实可用,吞吐流畅:在多轮压力测试与日常补全调用中,AMD 端点首字生成延迟低,上下文流式吞吐平稳,真正具备作为日常主力工具的素质。
  2. 完整开放 100 万 Token 上下文:DeepSeek V4 Flash 与 Vision 版均提供完整的 1,048,576 Tokens 上下文窗口,单次请求即可吞入整个工程的源码仓库或高分辨率设计图。
  3. 透明计费说明:官方计费字段明确标注免费使用,返回的 Points 仅作为相对使用量统计,不产生任何真实账单。

🛠️ 二、极速上手:从获取 Key 到接入 OpenCode

详细注册流程与完整截图可参阅专有指南: 👉 《AMD Radeon Cloud API 密钥获取与接入指南》

全程约 1 分钟即可完成配置:

第一步:登录 AMD 开发者平台

访问官方入口 https://developer.amd.com.cn/radeon/tokenfactory,右上角点击登录,支持手机验证码或邮箱注册登录,无需资质审核。

第二步:获取专属 API Key

登录后在 Token Factory 页面点击任意免费模型卡片,例如 DeepSeek-V4-Flash-0731。

!AMD 模型详情与 API Key 弹窗

在弹窗中点击 API Key 右侧的复制按钮,即可复制 sk- 开头的专属密钥。

第三步:直接接入 OpenCode

OpenCode 已原生支持 AMD Radeon Cloud,无需配置中间网关:

  • 打开 OpenCode 设置面板中的模型或提供商管理;
  • Base URL 填写:https://developer.amd.com.cn/radeon/api/v1
  • 填入复制的 API Key,模型指定为 DeepSeek-V4-FlashQwen3.8-Flash-Next 即可直接使用。

特别提示:社区多位开发者实测发现,ZCode 暂无法适配该端点,会出现请求握手异常,推荐直接使用已经完成集成的 OpenCode。

⚡ 三、原生支持 Anthropic Claude 格式

通常针对只支持 Anthropic 协议的工具,开发者需要搭建格式转换中间件。AMD Radeon Cloud 从底层直接兼容了 Anthropic 消息协议,在控制台切换至 Anthropic 标签页即可查看官方说明:

!AMD 原生支持 Anthropic 协议调用

1. OpenAI 格式调用示例

bash
curl https://developer.amd.com.cn/radeon/api/v1/chat/completions \
  -H "Authorization: Bearer $AMD_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "DeepSeek-V4-Flash",
    "messages": [
      {"role": "user", "content": "请用 TypeScript 编写一个高效的防抖节流装饰器"}
    ]
  }'

2. Anthropic 格式调用示例

bash
curl https://developer.amd.com.cn/radeon/api/v1/messages \
  -H "x-api-key: $AMD_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "DeepSeek-V4-Flash",
    "max_tokens": 1024,
    "messages": [
      {"role": "user", "content": "Hello Anthropic format!"}
    ]
  }'

3. Python SDK 调用示例

python
from openai import OpenAI

client = OpenAI(
    base_url="https://developer.amd.com.cn/radeon/api/v1",
    api_key="YOUR_AMD_API_KEY",
)

response = client.chat.completions.create(
    model="DeepSeek-V4-Flash",
    messages=[{"role": "user", "content": "请总结微内核架构的优缺点"}],
)

print(response.choices[0].message.content)

⚠️ 四、开发者实用避坑指南

  1. 认准 4 款公用免费模型:当前免费端点为 DeepSeek-V4-Flash-0731、DeepSeek-V4-Flash-Vision-Exp、Qwen3.8-Flash-Next 与 MiniCPM5-1B。
  2. 算力搭配建议:免费公用端点适合日常开发与轻量测试。对于企业级高并发或严格 SLA 需求,可搭配商业订阅方案,例如 OpenCode Go:👉 https://opencode.ai/go?ref=SVE58K5K80

📬 关注 Free AI API 免费算力雷达

Free AI API 实时追踪全球优质大模型的 0 元 API、限时免费活动与降价动态。欢迎订阅免费邮件周刊 Newsletter,第一时间获取最新算力资讯!

社区反馈

评论与你的 GitHub 账号绑定,登录后即可参与讨论。