NVIDIA NIM
NVIDIA 官方推理微服务,150+ 开源模型免费原型开发
2026/09/05 已核实
前往官方平台 ↗
额度速览
150+ 开源模型(DeepSeek V3.2 / Kimi K2.5 / MiniMax M2.7 / GLM-5.1 / Llama 3.1 405B 等)
免费原型开发:多数模型 40 RPM 速率上限、不限次调用、无 Token 计费;API Key 可设最长 12 个月有效
领取步骤
- 1 打开 build.nvidia.com,右上角 Login → Create Account(邮箱注册,支持中国大陆手机号验证)
- 2 进入任意模型页点击 Get API Key,获取密钥(有效期可选最长 12 个月)
- 3 按 OpenAI 兼容协议调用 https://integrate.api.nvidia.com/v1,模型 ID 为 org/model 格式(以各模型页为准)
怎么用
接口兼容 OpenAI 格式。base_url:https://integrate.api.nvidia.com/v1
示例模型:meta/llama-3.1-405b-instruct(可用模型以官方列表为准)
cURL
curl https://integrate.api.nvidia.com/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $API_KEY" \
-d '{
"model": "meta/llama-3.1-405b-instruct",
"messages": [{"role": "user", "content": "你好,介绍一下你自己"}]
}' Python(openai SDK)
from openai import OpenAI
import os
client = OpenAI(
api_key=os.environ["API_KEY"],
base_url="https://integrate.api.nvidia.com/v1",
)
resp = client.chat.completions.create(
model="meta/llama-3.1-405b-instruct",
messages=[{"role": "user", "content": "你好,介绍一下你自己"}],
)
print(resp.choices[0].message.content) 喜欢图形界面?看教程《领取第一个免费 Key 并接入 Cherry Studio》。 API 文档:https://build.nvidia.com ↗
⚠️ 坑点提醒
- 免费层仅限研究、开发与测试原型;正式商用需 NVIDIA AI Enterprise 授权
- 速率上限以控制台右上角个人配额显示为准(多数模型 40 RPM,部分更低);第三方有「1000 次/月」说法,以官方 FAQ 为准
- 海外服务,国内访问需自备网络环境
- 模型 ID 以各模型页为准(org/model 格式),命名与通用叫法略有差异