Skip to content
Dormon's Hideaway
Go back

英伟达免费API的真实边界

来源:X @XDmnnn0616

英伟达在 build.nvidia.com 的 NIM 平台上向开发者免费开放 DeepSeek V3.2、Kimi K2.5、MiniMax M2.7、GLM-5.1 等模型的 API。注册账号并验证手机号(支持 +86)即可领取,全程约 3 分钟 [0,1,2,7]。这些模型确实在平台目录中:MiniMax M2.7 有英伟达官方文档页,2026 年 4 月 11 日上线 [13];Kimi K2.5、GLM-5.1、DeepSeek V3.2 也出现在多篇独立报道和一篇模型评测论文中 [10,12,15]。所谓“免费”的范围,由额度、限速、官方定位这三个边界决定。

免费层边界:约 1,000 次调用与 40 RPM

免费层有额度限制。新账号获得约 1,000 个推理 credits,一次 API 调用约消耗 1 credit [2,9]。额度用完后,页面提供 “Request More” 入口,可再申请 4,000 credits [6]。素材说“没有 Token 计费、没有余额限制” [0]——没有 Token 计费属实,但“没有余额限制”不准确,免费层并非无上限。

免费层速率限制为 40 RPM(每分钟 40 次请求),约每 1.5 秒一次请求,与素材描述一致 [0,2];有实测者称实际达不到标称值,但限速后等待片刻即可恢复 [3]。超过速率限制会返回 429 错误 [2]

官方将免费层定位为试用(trial)。英伟达员工在开发者论坛的答复中称,trial 涵盖原型、研究、开发、测试、学习等场景,本身不设时间限制;但要将应用推向生产,需购买 NVIDIA AI Enterprise 许可 [6]

Key 的有效期在创建时可选,最长 12 个月 [2],另有教程建议直接选 “Never Expire” 以免到期后重新申请 [1]。创建后 Key 只完整显示一次,以 nvapi- 开头,需立即保存 [0,2]

模型目录与运行机制

不同报道对目录规模的统计不同:80+ 款 [10,16]、100+ 款 [2,9]、193 款 [1]、200+ 款 [7],口径和时间不同,但都表明这是一个大且持续更新的目录。新模型上线速度快:GLM-5.1 发布约两周后,GLM-5.2 已出现在平台上 [9];到 2026 年中,build.nvidia.com 首页展示的是 GLM-5.2、DeepSeek V4 Pro 等更新版本 [11]。素材所列版本号与真实模型一致,但“最新”是相对概念。

运行机制方面,NIM 将推理打包为 API 端点,运行时针对 NVIDIA GPU 用 TensorRT-LLM 等引擎做了预构建优化 [38,41,43]。素材称背后是 “H100 算力” [0]:有报道称模型托管在英伟达自有的 DGX Cloud 基础设施上 [8],也有文章描述为 H100/H200 集群 [36];英伟达官方页面仅说明 NIM 面向 NVIDIA 加速基础设施优化 [38,41],未明确免费层所用的具体 GPU 型号。接入方面,端点与 OpenAI 兼容,切换只需修改 base URL 和 model ID [2,9,43]

免费服务的稳定性是另一个问题。平台活跃时段多次出现 timeout 和 503 [2];开发者论坛上持续有模型不可用、超时、全量 429 的反馈 [14,20,22]。若将免费 API 用于生产,需将这些波动纳入容错设计。

免费的原因

素材将这次免费解读为生态布局:让开发者习惯通过 NVIDIA 的接口调用 Kimi、DeepSeek,日后迁移到其他云的成本升高,从而把平台变成 AI 时代的 App Store [0]。机制层面可印证此判断:免费层被官方界定为 trial,生产路径指向 NVIDIA AI Enterprise 许可 [6];额度用尽后有申请额外 credits 的入口,而非直接转为计费 [6]。这说明免费层的目标不是无限供给算力,而是让开发者在 NVIDIA 基础设施上完成原型和测试;需要生产级 SLA 时再进入付费通道 [6,8]。有观察者称之为“用免费模型把开发者锁进生态” [15]。素材所称的“国产大模型出海新路径”是其自身判断,现有证据未提供更多支持 [0]

原文更正:素材称免费层“没有余额限制”,实际新账号仅获约 1,000 credits 调用额度,用后可申请额外 4,000 credits。[9]

参考来源

  1. 素材原文(见文首来源链接)
  2. NVIDIA免费API的申请流程 - 大强同学 - 博客园
  3. 免費拿 NVIDIA 模型 API key!3 分鐘註冊可選 Kimi、DeepSeek、Llama 全能跑 | 動區動趨-最具影響力的區塊鏈新聞媒體
  4. OpenClaw限流有救了!免费Nvidia API+阿里云百炼接入指南 - DEV Community
  5. Nvidia 免費API 申請連結
  6. AImaster on X: “幸亏看了下评论区。穷逼可真多。。” / X
  7. “Request More” (+4,000 credits) option on build.nvidia.com - Access/Accounts - NVIDIA Developer Forums
  8. 🔥NVIDIA Gives FREE API Keys for 200+ AI Models
  9. Stop Paying $20/month. Use NVIDIA Build: 80+ Free AI Models
  10. Free LLM API (2026): NVIDIA Gives You 100+ Frontier Models for $0
  11. Coding Nexus | Medium
  12. NVIDIA Build
  13. React-ing to Grace Hopper 200 Five Open-Weights Coding Models, One React Native App, One GH200, One Weekend or: why SWE-Bench rankings mispredicted which model actually shipped
  14. minimaxai / minimax-m2.7
  15. Latest Models topics - NVIDIA Developer Forums
  16. Instagram
  17. 🚨 NVIDIA 親自下場!80+ 頂級 AI 模型 API 免費開放,DeepSeek、Kimi、MiniMax 全收編 NVIDIA 透過 build.nvidia.com 的 NIM 平台正式加入 AI 推論服務戰局,免費開放 80 多款頂級模型 API,涵蓋 DeepSeek V3.2、Kimi K2.5、MiniMax M2.7、GLM 5.1 與 GPT-OSS-120B,意圖成為開發者首次接觸開源模型的預設入口。
  18. Coding Nexus | Medium
  19. Four new open-weight LLMs for Voice AI: DeepSeek V3.2 …
  20. Open model bonanza! Gemma 4, DeepSeek V4, Kimi K2.6 …
  21. All new model are timeout
  22. GLM-4.7 vs DeepSeek V3.2 vs Kimi K2 Thinking …
  23. Reliability issues across glm5, kimi-k2.5, and minimax-m2.5
  24. Model Release Log | NVIDIA NeMo AutoModel
  25. OpenAI API并发限制深度解析:Rate Limits完整突破指南 - Cursor IDE 博客
  26. 速率限制| OpenAI 官方帮助文档中文版
  27. Microsoft Foundry 模型中的 Azure OpenAI 配額和限制 - Microsoft Foundry | Microsoft Learn
  28. 限流应对最佳实践 - 大模型服务平台百炼 - 阿里云
  29. 面向 API 客户的快速模式 | OpenAI
  30. API 客戶規模層級 | OpenAI
  31. Concurrency Rate Limiting: A $10,000 Issue - API - OpenAI Developer Community
  32. Concurrent request restriction - API - OpenAI Developer Community
  33. Rate limits | OpenAI API
  34. OpenAI API rate limits: practical guide for 2026 | CodeWords
  35. OpenAI Rate Limits: Complete Guide to TPM, RPM & Tier Limits (2026)
  36. Maximum number of parallel real-time sessions on a single OpenAI API key - API - OpenAI Developer Community
  37. 白嫖NVIDIA H100算力:手把手教你在Workbuddy上免费畅用顶级AI模型-腾讯云开发者社区-腾讯云
  38. 全新 – 由 NVIDIA H100 Tensor Core GPU 提供支持的 Amazon EC2 P5 实例,用于加速实现生成式人工智能和 HPC 应用程序 | 亚马逊AWS官方博客
  39. AI 智能体:专为推理、规划、行动而打造 | NVIDIA
  40. NVIDIA H100 Price Guide 2026: GPU Costs, Cloud Pricing & Buy vs Rent
  41. AI Models
  42. NVIDIA NIM for Developers
  43. H100 GPU
  44. How to Use NVIDIA NIM Free Models in Your AI Workflows
  45. I Built an AI Dockerfile Explainer Running on NVIDIA H100 GPU with …
  46. Edit your API key
  47. Renewing an API Key
  48. 结算  |  Gemini API  |  Google AI for Developers
  49. 配置API密钥过期时间 - IBM 文档
  50. API Key Expiry and Rotation - PolyAPI
  51. Update an API key | Elasticsearch API documentation
  52. Allow customisation of default and maximum API key periods. Deprecate never-expiring api keys · Issue #7924 · OctopusDeploy/Issues · GitHub
  53. API Key Extension
  54. Configuring API key expiration - IBM Documentation
  55. Loading…
  56. Feature Request: AppSync API key expiration notifications (e.g., 7 days before expiry) | AWS re:Post
  57. TensorRT-LLM/docs/source/blogs/Best_perf_practice_on_DeepSeek-R1_in_TensorRT-LLM.md at main · NVIDIA/TensorRT-LLM · GitHub
  58. NVIDIA TensorRT | NVIDIA 开发者
  59. Tensorrt Llm — 使用 NVIDIA TensorRT 优化 LLM 推理以实现最大吞吐量和最低延迟 | Hermes Agent
  60. TensorRT-LLM 优化:精通 NVIDIA 推理技术栈 | Introl Blog
  61. TensorRT_百度百科
  62. Optimizing LLMs for Performance and Accuracy with Post-Training …
  63. NVIDIA/TensorRT-LLM
  64. The complete DeepSeek model guide | Guides
  65. TensorRT-LLM Optimization | Introl Blog
  66. Overview — TensorRT LLM
  67. Accelerating Large Language Model Inference: High-performance TensorRT-LLM Inference Practices - Alibaba Cloud Community
  68. 速率限制| Gemini API - Google AI for Developers
  69. 免费 GPT API Key 领取:2026年免费额度汇总-腾讯云开发者社区-腾讯云
  70. 2026年免费使用 OpenAI API 密钥的三种方法
  71. 速率限制| OpenAI 官方帮助文档中文版
  72. API 客戶規模層級

Share this post:

Previous Post
Claude Pro 跨区价差从哪里来
Next Post
新年计划为何总是失败:改变从身份开始