# NVIDIA

> 在 OpenClaw 中使用 NVIDIA 的 OpenAI 兼容 API

- 网址：https://funcoding.ai/agents/openclaw/providers/nvidia/
- 来源：OpenClaw 官方文档原文（中文），MIT 许可，同步于 2026-10-11
- 官方原文：https://docs.openclaw.ai/zh-CN/providers/nvidia

---
NVIDIA 通过兼容 OpenAI 的 API 在
`https://integrate.api.nvidia.com/v1` 免费提供开放模型，使用从
[build.nvidia.com](https://build.nvidia.com/settings/api-keys) 获取的 API key
进行身份验证。OpenClaw 默认将 NVIDIA provider 设置为 Nemotron 3 Ultra，这是 NVIDIA
面向长上下文智能体任务的模型，总参数量为 550B，激活参数量为 55B，支持推理。

## 入门指南

**获取 API key**

在 [build.nvidia.com](https://build.nvidia.com/settings/api-keys) 创建 API key。

**导出密钥并运行新手引导**

```bash
export NVIDIA_API_KEY="nvapi-..."
openclaw onboard --auth-choice nvidia-api-key
```

**设置 NVIDIA 模型**

```bash
openclaw models set nvidia/nvidia/nemotron-3-ultra-550b-a55b
```

对于非交互式设置，请直接传入密钥：

```bash
openclaw onboard --auth-choice nvidia-api-key --nvidia-api-key "nvapi-..."
```

<div class="callout callout-warning">

`--nvidia-api-key` 会使密钥出现在 shell 历史记录和 `ps` 输出中。请尽可能优先使用
`NVIDIA_API_KEY` 环境变量。

</div>

## 配置示例

```json5
{
  env: { NVIDIA_API_KEY: "nvapi-..." },
  models: {
    providers: {
      nvidia: {
        baseUrl: "https://integrate.api.nvidia.com/v1",
        api: "openai-completions",
      },
    },
  },
  agents: {
    defaults: {
      model: { primary: "nvidia/nvidia/nemotron-3-ultra-550b-a55b" },
    },
  },
}
```

## 精选目录

配置 NVIDIA API key 后，设置和模型选择路径会从
`https://assets.ngc.nvidia.com/products/api-catalog/featured-models.json` 获取 NVIDIA 的公开精选模型目录，
并将结果缓存 24 小时（取前 32 个条目，并作为免费文本输入行导入）。
因此，build.nvidia.com 上的新精选模型无需等待 OpenClaw 发布新版本，
便会出现在设置和模型选择界面中。实时数据源可用时，在 NVIDIA 设置过程中，
返回的第一个模型会成为预选选项。

获取操作对 `assets.ngc.nvidia.com` 使用固定的 HTTPS 主机策略。如果未配置
NVIDIA API key，或者数据源不可用或格式错误，OpenClaw 将回退到下方的
内置目录和内置默认模型。

## Nemotron 3 Ultra

Nemotron 3 Ultra 是 OpenClaw 中的默认 NVIDIA 模型。NVIDIA 的
[`nvidia/nemotron-3-ultra-550b-a55b`](https://build.nvidia.com/nvidia/nemotron-3-ultra-550b-a55b)
构建页面将其列为可用的免费端点，并标明其上下文规格为 1M token。

内置 Ultra 行默认发送
`chat_template_kwargs: { enable_thinking: false, force_nonempty_content: true }`，
以确保普通聊天输出保留在可见答案中，而不会暴露推理文本。

如需 NVIDIA 默认选项中的最高能力，请使用 Ultra。如需较小的 Nemotron 3
选项，请继续选择 Super；也可以选择 NVIDIA 目录托管的第三方模型，
具体取决于它们的上下文、延迟或行为是否更适合你的需求。

## 内置回退目录

可选择的内置行是 NVIDIA 精选模型目录的快照。已弃用的兼容性行仍可通过
精确引用解析，但不会出现在模型选择器中。

| 模型引用                                   | 名称                  | 上下文    | 最大输出   |
| ------------------------------------------ | --------------------- | --------- | ---------- |
| `nvidia/nvidia/nemotron-3-ultra-550b-a55b` | Nemotron 3 Ultra 550B | 1,048,576 | 8,192      |
| `nvidia/nvidia/nemotron-3-super-120b-a12b` | Nemotron 3 Super 120B | 1,000,000 | 8,192      |
| `nvidia/z-ai/glm-5.2`                      | GLM 5.2               | 202,752   | 8,192      |
| `nvidia/moonshotai/kimi-k2.6`              | Kimi K2.6             | 262,144   | 8,192      |
| `nvidia/minimaxai/minimax-m3`              | Minimax M3            | 196,608   | 8,192      |
| `nvidia/deepseek-ai/deepseek-v4-pro`       | DeepSeek V4 Pro       | 262,144   | 16,384     |
| `nvidia/qwen/qwen3.5-397b-a17b`            | Qwen3.5 397B A17B     | 262,144   | 16,384     |

完整兼容性目录还为现有配置保留以下已发布引用：
`nvidia/moonshotai/kimi-k2.5`、`nvidia/z-ai/glm-5.1`、
`nvidia/minimaxai/minimax-m2.5`、`nvidia/z-ai/glm5` 和
`nvidia/minimaxai/minimax-m2.7`。它们仍可通过精确引用使用，但绝不会出现在
新手引导或模型选择器中。

## 高级配置

<details>
<summary>自动启用行为</summary>

设置 `NVIDIA_API_KEY` 环境变量，或在新手引导期间存储密钥后，
provider 会自动启用。除密钥外，无需显式配置 provider。

</details>

<details>
<summary>目录和定价</summary>

配置 NVIDIA 身份验证后，OpenClaw 会优先使用 NVIDIA 的公开精选模型目录，
并将其缓存 24 小时。可选择的内置回退目录是 NVIDIA 精选模型目录的静态快照；
已弃用的精确引用兼容性行不会显示在模型选择器中。由于 NVIDIA 目前为所列模型
提供免费的 API 访问，因此源代码中的费用默认为 `0`。

</details>

<details>
<summary>兼容 OpenAI 的端点</summary>

OpenClaw 使用 `openai-completions` 适配器，通过标准
`/v1` 聊天补全路由与 NVIDIA 通信。任何兼容 OpenAI 的工具
使用 NVIDIA base URL 时都应能直接运行。

</details>

<details>
<summary>Nemotron 3 Ultra 推理参数</summary>

NVIDIA 的 Ultra 示例请求使用 `chat_template_kwargs.enable_thinking`
和 `reasoning_budget` 输出推理内容。对于普通聊天用途，OpenClaw 的
内置 Ultra 行默认禁用模板思考。如果需要选择启用 NVIDIA 推理输出，
或强制设置其他 NVIDIA 专属请求字段，请设置每模型参数，并将提供商专属覆盖
限定在 NVIDIA 模型范围内：

```json5
{
  agents: {
    defaults: {
      models: {
        "nvidia/nvidia/nemotron-3-ultra-550b-a55b": {
          params: {
            chat_template_kwargs: { enable_thinking: true },
            extra_body: { reasoning_budget: 16384 },
          },
        },
      },
    },
  },
}
```

`params.chat_template_kwargs` 会合并到请求中已有的任何 `chat_template_kwargs`，
而不会替换整个对象。
`params.extra_body` 是最终兼容 OpenAI 的请求正文覆盖项，
会覆盖发生冲突的有效负载键，因此仅应用于 NVIDIA 为所选端点记录的字段。

</details>

<details>
<summary>响应缓慢的自定义提供商</summary>

NVIDIA 托管的某些自定义模型可能需要超过默认约 120 秒的模型空闲监视超时，
才会发出第一个响应分块。对于自定义 NVIDIA provider 条目，应提高 provider
超时，而不是整个 Agent Runtimes 超时；`timeoutSeconds` 涵盖 provider
HTTP 请求，并会提高该 provider 的空闲/流式传输监视超时上限：

```json5
{
  models: {
    providers: {
      "custom-integrate-api-nvidia-com": {
        baseUrl: "https://integrate.api.nvidia.com/v1",
        api: "openai-completions",
        apiKey: "NVIDIA_API_KEY",
        timeoutSeconds: 300,
      },
    },
  },
  agents: {
    defaults: {
      models: {
        "custom-integrate-api-nvidia-com/meta/llama-3.1-70b-instruct": {
          params: { thinking: "off" },
        },
      },
    },
  },
}
```

</details>

<div class="callout callout-tip">

NVIDIA 模型目前可免费使用。有关最新可用性和速率限制的详细信息，请查看
[build.nvidia.com](https://build.nvidia.com/)。

</div>

## 相关内容

- [模型选择](https://funcoding.ai/agents/openclaw/concepts/model-providers/)：选择提供商、模型引用和故障转移行为。
- [配置参考](https://funcoding.ai/agents/openclaw/gateway/configuration-reference/)：智能体、模型和提供商的完整配置参考。
