GLM 5.3 Flash (Vultr)
Vultr Serverless Inference endpoint for GLM 5.3 Flash ($0.10 in, $0.35 out).
更新于 2026/9/160 个代码示例
关于该模型
为什么选择 GLM-5.3-Flash?
GLM-5.3-Flash(原代号 Ox Alpha)是智谱 AI 发布的轻量旗舰模型,采用 320B 总参数、18B 激活的混合注意力 MoE 架构,支持 100 万 Token 上下文与亚秒级响应,官方提供终身免费调用额度。
如何免费接入 (通过 Vultr)
暂无详细的接入说明。
在浏览器里试用
选个模型、粘贴你自己的免费 Key,即可运行。你的 Key 只用于调用一次该提供商,绝不存储在我们的服务器上。
选个模型、粘贴你自己的免费 Key,即可运行。你的 Key 只用于调用一次该提供商,绝不存储在我们的服务器上。
调用代码示例
暂未提供代码示例。
社区反馈
评论与你的 GitHub 账号绑定,登录后即可参与讨论。