Free Nemotron 3.5 Lightning API
更新于 2026/8/29
NVIDIA's fastest 30B-A3B MoE model with Mamba-2 hybrid architecture, NVFP4 quantization, and 1M context.
关于该模型
为什么要选择 Nemotron 3.5 Lightning?
Nemotron 3.5 Lightning 是 NVIDIA 于 2026 年 8 月最新发布的轻量级旗舰 MoE 模型。总参数 30B,每次仅激活 3B 参数,融合了 Mamba-2 状态空间模型与 MoE 混合架构,专为高并发 Coding Agent、工具编排与实时自动补全量身定制。
核心优势与技术突破
- 30B-A3B 极速架构:单 Token 推理延迟大幅低于传统 Dense 架构,首字生成时间达到毫秒级,大幅缩短 Agent 决策循环等待时间。
- 原生 NVFP4 深度优化:在 NVIDIA Blackwell / Hopper 架构 GPU 上深度优化,显存开销更小、吞吐速度翻倍。
- 100 万(1M)Token 上下文:支持长文本代码审阅与复杂系统日志分析,长程上下文忠实度极高。
在浏览器里试用
选个模型、粘贴你自己的免费 Key,即可运行。你的 Key 只用于调用一次该提供商,绝不存储在我们的服务器上。
选个模型、粘贴你自己的免费 Key,即可运行。你的 Key 只用于调用一次该提供商,绝不存储在我们的服务器上。
如何调用 Nemotron 3.5 Lightning
curl
curl https://integrate.api.nvidia.com/v1/chat/completions \
-H "Authorization: Bearer $NVIDIA_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "nvidia/nemotron-3.5-lightning-30b-a3b",
"messages": [{"role": "user", "content": "Explain Mamba-2 state space models."}]
}'提供方详情
以下平台通过免费层、试用额度或每日配额提供 Nemotron 3.5 Lightning 的免费访问。
| 供应商 | 上下文窗口 | 免费配额 | 需绑卡 | 评分 | 操作 |
|---|---|---|---|---|---|
| NVIDIA NIM | 暂无 | 每 分钟 40 次请求 | 否 | Details |
常见问题
知道 Nemotron 3.5 Lightning 的其他免费渠道?
分享您知道的免费访问方式,帮助整个社区。
社区反馈
评论与你的 GitHub 账号绑定,登录后即可参与讨论。