Chuyển đến nội dung chính
NVIDIA cung cấp miễn phí các mô hình mở thông qua API tương thích với OpenAI tại https://integrate.api.nvidia.com/v1, được xác thực bằng khóa API từ build.nvidia.com. OpenClaw mặc định dùng Nemotron 3 Ultra cho nhà cung cấp NVIDIA, mô hình suy luận có tổng 550B tham số / 55B tham số hoạt động của NVIDIA dành cho tác vụ tác tử có ngữ cảnh dài.

Bắt đầu

1

Lấy khóa API

Tạo khóa API tại build.nvidia.com.
2

Xuất khóa và chạy quy trình thiết lập ban đầu

3

Đặt mô hình NVIDIA

Để thiết lập không tương tác, hãy truyền trực tiếp khóa:
--nvidia-api-key lưu khóa vào lịch sử shell và đầu ra ps. Khi có thể, nên dùng biến môi trường NVIDIA_API_KEY.

Ví dụ cấu hình

Danh mục nổi bật

Khi khóa API NVIDIA được cấu hình, các luồng thiết lập và chọn mô hình sẽ tải danh mục mô hình nổi bật công khai của NVIDIA từ https://assets.ngc.nvidia.com/products/api-catalog/featured-models.json và lưu kết quả vào bộ nhớ đệm trong 24 giờ (32 mục đầu tiên, được nhập dưới dạng các hàng đầu vào văn bản miễn phí). Vì vậy, các mô hình nổi bật mới từ build.nvidia.com sẽ xuất hiện trong các giao diện thiết lập và chọn mô hình mà không cần chờ bản phát hành OpenClaw. Khi nguồn cấp dữ liệu trực tiếp khả dụng, mô hình đầu tiên được trả về sẽ là tùy chọn được chọn sẵn trong quá trình thiết lập NVIDIA. Quá trình tải sử dụng chính sách máy chủ HTTPS cố định cho assets.ngc.nvidia.com. Nếu không có khóa API NVIDIA được cấu hình, hoặc nếu nguồn cấp dữ liệu không khả dụng hay không đúng định dạng, OpenClaw sẽ dùng danh mục đi kèm và giá trị mặc định đi kèm bên dưới.

Nemotron 3 Ultra

Nemotron 3 Ultra là mô hình NVIDIA mặc định trong OpenClaw. Trang build của NVIDIA cho nvidia/nemotron-3-ultra-550b-a55b liệt kê mô hình này là điểm cuối miễn phí khả dụng với đặc tả ngữ cảnh 1 triệu token. Hàng Ultra đi kèm gửi chat_template_kwargs: { enable_thinking: false, force_nonempty_content: true } theo mặc định để đầu ra trò chuyện thông thường nằm trong câu trả lời hiển thị thay vì làm lộ văn bản suy luận. Dùng Ultra để có tùy chọn NVIDIA mặc định với năng lực cao nhất. Giữ Super được chọn khi bạn muốn tùy chọn Nemotron 3 nhỏ hơn, hoặc chọn một trong các mô hình bên thứ ba được lưu trữ trong danh mục của NVIDIA khi ngữ cảnh, độ trễ hoặc hành vi của chúng phù hợp hơn.

Danh mục dự phòng đi kèm

Các hàng đi kèm có thể chọn là bản chụp danh mục mô hình nổi bật của NVIDIA. Các hàng tương thích đã ngừng khuyến nghị vẫn có thể được phân giải bằng tham chiếu chính xác nhưng không xuất hiện trong bộ chọn mô hình. Danh mục tương thích đầy đủ cũng giữ lại các tham chiếu đã phát hành sau đây cho các cấu hình hiện có: nvidia/moonshotai/kimi-k2.5, nvidia/z-ai/glm-5.1, nvidia/minimaxai/minimax-m2.5, nvidia/z-ai/glm5nvidia/minimaxai/minimax-m2.7. Chúng vẫn khả dụng qua tham chiếu chính xác nhưng không bao giờ xuất hiện trong quy trình thiết lập ban đầu hoặc bộ chọn mô hình.

Cấu hình nâng cao

Nhà cung cấp tự động được bật khi biến môi trường NVIDIA_API_KEY được đặt hoặc khi khóa đã được lưu trong quá trình thiết lập ban đầu. Ngoài khóa, không cần cấu hình nhà cung cấp rõ ràng nào khác.
OpenClaw ưu tiên danh mục mô hình nổi bật công khai của NVIDIA khi thông tin xác thực NVIDIA được cấu hình và lưu danh mục này vào bộ nhớ đệm trong 24 giờ. Danh mục dự phòng đi kèm có thể chọn là bản chụp tĩnh của danh mục mô hình nổi bật của NVIDIA; các hàng tương thích theo tham chiếu chính xác đã ngừng khuyến nghị sẽ bị ẩn khỏi bộ chọn mô hình. Chi phí mặc định là 0 trong mã nguồn vì NVIDIA hiện cung cấp quyền truy cập API miễn phí cho các mô hình được liệt kê.
OpenClaw giao tiếp với NVIDIA bằng bộ điều hợp openai-completions qua tuyến hoàn thành trò chuyện /v1 tiêu chuẩn. Mọi công cụ tương thích với OpenAI đều có thể hoạt động ngay với URL cơ sở của NVIDIA.
Yêu cầu mẫu Ultra của NVIDIA sử dụng chat_template_kwargs.enable_thinkingreasoning_budget cho đầu ra suy luận. Hàng Ultra đi kèm của OpenClaw mặc định tắt suy luận theo mẫu khi trò chuyện thông thường. Nếu cần bật đầu ra suy luận của NVIDIA hoặc buộc sử dụng các trường yêu cầu khác dành riêng cho NVIDIA, hãy đặt tham số theo từng mô hình và giới hạn các giá trị ghi đè dành riêng cho nhà cung cấp trong phạm vi mô hình NVIDIA:
params.chat_template_kwargs được hợp nhất vào mọi chat_template_kwargs đã có trong yêu cầu thay vì thay thế toàn bộ đối tượng. params.extra_body là giá trị ghi đè cuối cùng cho phần thân yêu cầu tương thích với OpenAI và sẽ ghi đè các khóa tải trọng trùng nhau, vì vậy chỉ dùng nó cho các trường mà NVIDIA cung cấp tài liệu cho điểm cuối đã chọn.
Một số mô hình tùy chỉnh do NVIDIA lưu trữ có thể mất nhiều thời gian hơn khoảng 120 giây mặc định của bộ giám sát trạng thái chờ mô hình trước khi phát ra đoạn phản hồi đầu tiên. Đối với các mục nhà cung cấp NVIDIA tùy chỉnh, hãy tăng thời gian chờ của nhà cung cấp thay vì thời gian chờ của toàn bộ môi trường chạy tác tử; timeoutSeconds áp dụng cho các yêu cầu HTTP của nhà cung cấp và tăng ngưỡng của bộ giám sát trạng thái chờ/luồng cho nhà cung cấp đó:
Các mô hình NVIDIA hiện được sử dụng miễn phí. Hãy kiểm tra build.nvidia.com để biết thông tin mới nhất về khả dụng và giới hạn tốc độ.

Liên quan

Chọn mô hình

Chọn nhà cung cấp, tham chiếu mô hình và hành vi chuyển đổi dự phòng.

Tham chiếu cấu hình

Tham chiếu cấu hình đầy đủ cho tác tử, mô hình và nhà cung cấp.