iG iGetToken
菜单

NVIDIA NIM

NVIDIA 官方推理微服务,150+ 开源模型免费原型开发

2026/09/05 已核实 前往官方平台 ↗

额度速览

150+ 开源模型(DeepSeek V3.2 / Kimi K2.5 / MiniMax M2.7 / GLM-5.1 / Llama 3.1 405B 等)

免费原型开发:多数模型 40 RPM 速率上限、不限次调用、无 Token 计费;API Key 可设最长 12 个月有效

永久免费

领取步骤

  1. 1 打开 build.nvidia.com,右上角 Login → Create Account(邮箱注册,支持中国大陆手机号验证)
  2. 2 进入任意模型页点击 Get API Key,获取密钥(有效期可选最长 12 个月)
  3. 3 按 OpenAI 兼容协议调用 https://integrate.api.nvidia.com/v1,模型 ID 为 org/model 格式(以各模型页为准)

怎么用

接口兼容 OpenAI 格式。base_url:https://integrate.api.nvidia.com/v1 示例模型:meta/llama-3.1-405b-instruct(可用模型以官方列表为准)

cURL

curl https://integrate.api.nvidia.com/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $API_KEY" \
  -d '{
    "model": "meta/llama-3.1-405b-instruct",
    "messages": [{"role": "user", "content": "你好,介绍一下你自己"}]
  }'

Python(openai SDK)

from openai import OpenAI
import os

client = OpenAI(
    api_key=os.environ["API_KEY"],
    base_url="https://integrate.api.nvidia.com/v1",
)

resp = client.chat.completions.create(
    model="meta/llama-3.1-405b-instruct",
    messages=[{"role": "user", "content": "你好,介绍一下你自己"}],
)
print(resp.choices[0].message.content)

喜欢图形界面?看教程《领取第一个免费 Key 并接入 Cherry Studio》。 API 文档:https://build.nvidia.com ↗

⚠️ 坑点提醒

  • 免费层仅限研究、开发与测试原型;正式商用需 NVIDIA AI Enterprise 授权
  • 速率上限以控制台右上角个人配额显示为准(多数模型 40 RPM,部分更低);第三方有「1000 次/月」说法,以官方 FAQ 为准
  • 海外服务,国内访问需自备网络环境
  • 模型 ID 以各模型页为准(org/model 格式),命名与通用叫法略有差异