跳到正文
FunCoding

搜索

搜索文档、文章、Skill 和 MCP

NVIDIA

在 OpenClaw 中使用 NVIDIA 的 OpenAI 兼容 API

NVIDIA 通过兼容 OpenAI 的 API 在 https://integrate.api.nvidia.com/v1 免费提供开放模型,使用从 build.nvidia.com 获取的 API key 进行身份验证。OpenClaw 默认将 NVIDIA provider 设置为 Nemotron 3 Ultra,这是 NVIDIA 面向长上下文智能体任务的模型,总参数量为 550B,激活参数量为 55B,支持推理。

入门指南

获取 API key

在 build.nvidia.com 创建 API key。

导出密钥并运行新手引导

export NVIDIA_API_KEY="nvapi-..."
openclaw onboard --auth-choice nvidia-api-key

设置 NVIDIA 模型

openclaw models set nvidia/nvidia/nemotron-3-ultra-550b-a55b

对于非交互式设置,请直接传入密钥:

openclaw onboard --auth-choice nvidia-api-key --nvidia-api-key "nvapi-..."

--nvidia-api-key 会使密钥出现在 shell 历史记录和 ps 输出中。请尽可能优先使用 NVIDIA_API_KEY 环境变量。

配置示例

{
  env: { NVIDIA_API_KEY: "nvapi-..." },
  models: {
    providers: {
      nvidia: {
        baseUrl: "https://integrate.api.nvidia.com/v1",
        api: "openai-completions",
      },
    },
  },
  agents: {
    defaults: {
      model: { primary: "nvidia/nvidia/nemotron-3-ultra-550b-a55b" },
    },
  },
}

精选目录

配置 NVIDIA API key 后,设置和模型选择路径会从 https://assets.ngc.nvidia.com/products/api-catalog/featured-models.json 获取 NVIDIA 的公开精选模型目录, 并将结果缓存 24 小时(取前 32 个条目,并作为免费文本输入行导入)。 因此,build.nvidia.com 上的新精选模型无需等待 OpenClaw 发布新版本, 便会出现在设置和模型选择界面中。实时数据源可用时,在 NVIDIA 设置过程中, 返回的第一个模型会成为预选选项。

获取操作对 assets.ngc.nvidia.com 使用固定的 HTTPS 主机策略。如果未配置 NVIDIA API key,或者数据源不可用或格式错误,OpenClaw 将回退到下方的 内置目录和内置默认模型。

Nemotron 3 Ultra

Nemotron 3 Ultra 是 OpenClaw 中的默认 NVIDIA 模型。NVIDIA 的 nvidia/nemotron-3-ultra-550b-a55b 构建页面将其列为可用的免费端点,并标明其上下文规格为 1M token。

内置 Ultra 行默认发送 chat_template_kwargs: { enable_thinking: false, force_nonempty_content: true }, 以确保普通聊天输出保留在可见答案中,而不会暴露推理文本。

如需 NVIDIA 默认选项中的最高能力,请使用 Ultra。如需较小的 Nemotron 3 选项,请继续选择 Super;也可以选择 NVIDIA 目录托管的第三方模型, 具体取决于它们的上下文、延迟或行为是否更适合你的需求。

内置回退目录

可选择的内置行是 NVIDIA 精选模型目录的快照。已弃用的兼容性行仍可通过 精确引用解析,但不会出现在模型选择器中。

模型引用名称上下文最大输出
nvidia/nvidia/nemotron-3-ultra-550b-a55bNemotron 3 Ultra 550B1,048,5768,192
nvidia/nvidia/nemotron-3-super-120b-a12bNemotron 3 Super 120B1,000,0008,192
nvidia/z-ai/glm-5.2GLM 5.2202,7528,192
nvidia/moonshotai/kimi-k2.6Kimi K2.6262,1448,192
nvidia/minimaxai/minimax-m3Minimax M3196,6088,192
nvidia/deepseek-ai/deepseek-v4-proDeepSeek V4 Pro262,14416,384
nvidia/qwen/qwen3.5-397b-a17bQwen3.5 397B A17B262,14416,384

完整兼容性目录还为现有配置保留以下已发布引用: nvidia/moonshotai/kimi-k2.5、nvidia/z-ai/glm-5.1、 nvidia/minimaxai/minimax-m2.5、nvidia/z-ai/glm5 和 nvidia/minimaxai/minimax-m2.7。它们仍可通过精确引用使用,但绝不会出现在 新手引导或模型选择器中。

高级配置

自动启用行为

设置 NVIDIA_API_KEY 环境变量,或在新手引导期间存储密钥后, provider 会自动启用。除密钥外,无需显式配置 provider。

目录和定价

配置 NVIDIA 身份验证后,OpenClaw 会优先使用 NVIDIA 的公开精选模型目录, 并将其缓存 24 小时。可选择的内置回退目录是 NVIDIA 精选模型目录的静态快照; 已弃用的精确引用兼容性行不会显示在模型选择器中。由于 NVIDIA 目前为所列模型 提供免费的 API 访问,因此源代码中的费用默认为 0。

兼容 OpenAI 的端点

OpenClaw 使用 openai-completions 适配器,通过标准 /v1 聊天补全路由与 NVIDIA 通信。任何兼容 OpenAI 的工具 使用 NVIDIA base URL 时都应能直接运行。

Nemotron 3 Ultra 推理参数

NVIDIA 的 Ultra 示例请求使用 chat_template_kwargs.enable_thinking 和 reasoning_budget 输出推理内容。对于普通聊天用途,OpenClaw 的 内置 Ultra 行默认禁用模板思考。如果需要选择启用 NVIDIA 推理输出, 或强制设置其他 NVIDIA 专属请求字段,请设置每模型参数,并将提供商专属覆盖 限定在 NVIDIA 模型范围内:

{
  agents: {
    defaults: {
      models: {
        "nvidia/nvidia/nemotron-3-ultra-550b-a55b": {
          params: {
            chat_template_kwargs: { enable_thinking: true },
            extra_body: { reasoning_budget: 16384 },
          },
        },
      },
    },
  },
}

params.chat_template_kwargs 会合并到请求中已有的任何 chat_template_kwargs, 而不会替换整个对象。 params.extra_body 是最终兼容 OpenAI 的请求正文覆盖项, 会覆盖发生冲突的有效负载键,因此仅应用于 NVIDIA 为所选端点记录的字段。

响应缓慢的自定义提供商

NVIDIA 托管的某些自定义模型可能需要超过默认约 120 秒的模型空闲监视超时, 才会发出第一个响应分块。对于自定义 NVIDIA provider 条目,应提高 provider 超时,而不是整个 Agent Runtimes 超时;timeoutSeconds 涵盖 provider HTTP 请求,并会提高该 provider 的空闲/流式传输监视超时上限:

{
  models: {
    providers: {
      "custom-integrate-api-nvidia-com": {
        baseUrl: "https://integrate.api.nvidia.com/v1",
        api: "openai-completions",
        apiKey: "NVIDIA_API_KEY",
        timeoutSeconds: 300,
      },
    },
  },
  agents: {
    defaults: {
      models: {
        "custom-integrate-api-nvidia-com/meta/llama-3.1-70b-instruct": {
          params: { thinking: "off" },
        },
      },
    },
  },
}

NVIDIA 模型目前可免费使用。有关最新可用性和速率限制的详细信息,请查看 build.nvidia.com。

相关内容

  • 模型选择:选择提供商、模型引用和故障转移行为。
  • 配置参考:智能体、模型和提供商的完整配置参考。