GLM 5.3 Flash (Vultr)

Vultr Serverless Inference endpoint for GLM 5.3 Flash ($0.10 in, $0.35 out).

更新于 2026/9/160 个代码示例

关于该模型

为什么选择 GLM-5.3-Flash?

GLM-5.3-Flash(原代号 Ox Alpha)是智谱 AI 发布的轻量旗舰模型,采用 320B 总参数、18B 激活的混合注意力 MoE 架构,支持 100 万 Token 上下文与亚秒级响应,官方提供终身免费调用额度。

如何免费接入 (通过 Vultr)

暂无详细的接入说明。

在浏览器里试用

选个模型、粘贴你自己的免费 Key,即可运行。你的 Key 只用于调用一次该提供商,绝不存储在我们的服务器上。

选个模型、粘贴你自己的免费 Key,即可运行。你的 Key 只用于调用一次该提供商,绝不存储在我们的服务器上。

调用代码示例

暂未提供代码示例。

社区反馈

评论与你的 GitHub 账号绑定,登录后即可参与讨论。