Quy tắc nhanh
Tham chiếu mô hình và trình trợ giúp CLI
Tham chiếu mô hình và trình trợ giúp CLI
- Tham chiếu mô hình sử dụng
provider/model(ví dụ:opencode/claude-opus-4-6). agents.defaults.modelslưu bí danh và cài đặt theo từng mô hình;agents.defaults.modelPolicy.allowlà danh sách cho phép ghi đè tường minh không bắt buộc.- Trình trợ giúp CLI:
openclaw onboard,openclaw models list,openclaw models set <provider/model>. models.providers.*.contextWindow/contextTokens/maxTokensđặt giá trị mặc định ở cấp nhà cung cấp;models.providers.*.models[].contextWindow/contextTokens/maxTokensghi đè chúng theo từng mô hình.- Quy tắc dự phòng, phép thăm dò thời gian chờ và khả năng duy trì ghi đè phiên: Chuyển đổi dự phòng mô hình.
Thêm xác thực nhà cung cấp không thay đổi mô hình chính
Thêm xác thực nhà cung cấp không thay đổi mô hình chính
openclaw configure giữ nguyên agents.defaults.model.primary hiện có khi bạn thêm hoặc xác thực lại một nhà cung cấp. openclaw models auth login cũng làm như vậy trừ khi bạn truyền --set-default. Plugin nhà cung cấp vẫn có thể trả về mô hình mặc định được đề xuất trong bản vá cấu hình xác thực, nhưng khi đã có mô hình chính, OpenClaw xem đó là “cung cấp mô hình này để sử dụng”, chứ không phải “thay thế mô hình chính hiện tại”.Để chủ động chuyển đổi mô hình mặc định, hãy sử dụng openclaw models set <provider/model> hoặc openclaw models auth login --provider <id> --set-default.Phân tách nhà cung cấp/môi trường thực thi OpenAI
Phân tách nhà cung cấp/môi trường thực thi OpenAI
Tham chiếu mô hình OpenAI và môi trường thực thi tác nhân là hai phần riêng biệt:
openai/<model>chọn nhà cung cấp và mô hình OpenAI chính thức. Chỉ riêng tiền tố không bao giờ chọn Codex.- Khi chính sách môi trường thực thi của nhà cung cấp/mô hình chưa được đặt hoặc là
auto, OpenAI chỉ có thể chọn ngầm Codex cho đúng một tuyến Platform Responses HTTPS chính thức hoặc ChatGPT Responses không có ghi đè yêu cầu do người dùng thiết lập. - Các bộ điều hợp Completions do người dùng thiết lập, điểm cuối tùy chỉnh và tuyến có hành vi yêu cầu do người dùng thiết lập vẫn chạy trên OpenClaw. Các điểm cuối HTTP văn bản thuần chính thức bị từ chối.
- Các tham chiếu mô hình Codex cũ là cấu hình cũ mà doctor viết lại thành
openai/<model>. agentRuntime.id: "openclaw"của nhà cung cấp/mô hình tường minh giữ một tuyến vốn đủ điều kiện trên OpenClaw.agentRuntime.id: "codex"yêu cầu Codex và từ chối an toàn khi tuyến hiệu lực không tương thích với Codex.
agentRuntime.id: "codex" tường minh của nhà cung cấp/mô hình hoặc tham chiếu codex/<model> cũ yêu cầu Plugin này. Chỉ riêng tiền tố openai/* thì không.Thiết lập OpenAI mới sử dụng tham chiếu GPT-5.6 dành riêng cho từng tuyến: thiết lập bằng khóa API chọn
openai/gpt-5.6 (mã API trực tiếp trần phân giải thành Sol), trong khi
OAuth ChatGPT/Codex chọn chính xác openai/gpt-5.6-sol cho danh mục Codex
gốc. Các mô hình chính tường minh hiện có, bao gồm openai/gpt-5.5, được
giữ nguyên khi thêm hoặc làm mới xác thực OpenAI. GPT-5.5 vẫn khả dụng
thông qua một trong hai môi trường thực thi như một lựa chọn khôi phục tường minh cho các tài khoản không
có quyền truy cập GPT-5.6.Môi trường thực thi CLI
Môi trường thực thi CLI
Môi trường thực thi CLI sử dụng cùng cách phân tách: chọn tham chiếu mô hình chính thức như
anthropic/claude-* hoặc google/gemini-*, sau đó đặt chính sách môi trường thực thi của nhà cung cấp/mô hình thành claude-cli hoặc google-gemini-cli khi bạn muốn dùng phần phụ trợ CLI cục bộ.Các tham chiếu claude-cli/* và google-gemini-cli/* cũ được di chuyển trở lại tham chiếu nhà cung cấp chính thức, còn môi trường thực thi được ghi riêng. Các tham chiếu codex-cli/* cũ được di chuyển sang openai/* và sử dụng tuyến máy chủ ứng dụng Codex; OpenClaw không còn duy trì phần phụ trợ Codex CLI đóng gói sẵn.Cấu hình nhà cung cấp trong giao diện điều khiển
Mở Settings → Model Providers trong giao diện điều khiển để thêm, thay thế hoặc xóa các khóa API nhà cung cấp được lưu trongmodels.providers.<id>.apiKey. Trang này xác định mỗi khóa API đến từ cấu hình OpenClaw hay biến môi trường mà không hiển thị thông tin xác thực. Các khóa do môi trường cung cấp vẫn được quản lý bởi môi trường tiến trình Gateway.
Sử dụng Test connection để chạy phép thăm dò trực tiếp nhà cung cấp và xem độ trễ hoặc lỗi đã phân loại về xác thực, giới hạn tốc độ, thanh toán, hết thời gian chờ hay phản hồi. Phép thăm dò gửi yêu cầu thực sự tới nhà cung cấp và có thể tiêu thụ một lượng nhỏ token. Bạn cũng có thể đăng xuất khỏi hồ sơ OAuth và token trên thẻ nhà cung cấp.
Thẻ Default models quản lý mô hình chính, các mô hình dự phòng có thứ tự và mô hình tiện ích từ danh mục mô hình đã cấu hình. Chọn các mô hình, sau đó lưu chúng cùng nhau vào các cài đặt agents.defaults.model và agents.defaults.utilityModel hiện có. Đối với mô hình tiện ích, Automatic để cài đặt ở trạng thái chưa thiết lập và Disabled lưu một chuỗi rỗng để tắt định tuyến tiện ích.
Hành vi nhà cung cấp do Plugin sở hữu
Phần lớn logic dành riêng cho nhà cung cấp nằm trong các Plugin nhà cung cấp (registerProvider(...)), còn OpenClaw duy trì vòng lặp suy luận chung. Các Plugin sở hữu quy trình thiết lập ban đầu, danh mục mô hình, ánh xạ biến môi trường xác thực, chuẩn hóa giao vận/cấu hình, dọn dẹp lược đồ công cụ, phân loại chuyển đổi dự phòng, làm mới OAuth, báo cáo mức sử dụng, hồ sơ tư duy/suy luận và nhiều chức năng khác.
Danh sách đầy đủ các hook SDK nhà cung cấp và ví dụ Plugin đóng gói sẵn nằm trong Plugin nhà cung cấp. Nhà cung cấp cần một trình thực thi yêu cầu hoàn toàn tùy chỉnh là một bề mặt mở rộng riêng biệt và chuyên sâu hơn.
Hành vi trình chạy do nhà cung cấp sở hữu nằm trên các hook nhà cung cấp tường minh như chính sách phát lại, chuẩn hóa lược đồ công cụ, bao luồng và trình trợ giúp giao vận/yêu cầu. Túi tĩnh
ProviderPlugin.capabilities cũ chỉ dành cho khả năng tương thích và logic trình chạy dùng chung không còn đọc nó.Luân phiên khóa API
Nguồn khóa và mức ưu tiên
Nguồn khóa và mức ưu tiên
Cấu hình nhiều khóa qua:
OPENCLAW_LIVE_<PROVIDER>_KEY(ghi đè trực tiếp duy nhất, mức ưu tiên cao nhất)<PROVIDER>_API_KEYS(danh sách phân tách bằng dấu phẩy hoặc dấu chấm phẩy)<PROVIDER>_API_KEY(khóa chính)<PROVIDER>_API_KEY_*(danh sách được đánh số, ví dụ<PROVIDER>_API_KEY_1)
GOOGLE_API_KEY cũng được dùng làm phương án dự phòng. Thứ tự chọn khóa giữ nguyên mức ưu tiên và loại bỏ các giá trị trùng lặp.Thời điểm luân phiên bắt đầu
Thời điểm luân phiên bắt đầu
- Yêu cầu chỉ được thử lại với khóa tiếp theo khi có phản hồi giới hạn tốc độ (ví dụ
429,rate_limit,quota,resource exhausted,Too many concurrent requests,ThrottlingException,concurrency limit reached,workers_ai ... quota limit exceededhoặc thông báo giới hạn mức sử dụng định kỳ). - Các lỗi không liên quan đến giới hạn tốc độ sẽ thất bại ngay lập tức; hệ thống không thử luân phiên khóa.
- Khi tất cả khóa ứng viên đều thất bại, lỗi cuối cùng từ lần thử cuối sẽ được trả về.
Plugin nhà cung cấp chính thức
Các Plugin nhà cung cấp chính thức phát hành các hàng danh mục mô hình riêng. Những nhà cung cấp này không yêu cầu mục mô hìnhmodels.providers; hãy bật Plugin nhà cung cấp, đặt thông tin xác thực và chọn một mô hình. Chỉ sử dụng models.providers cho các nhà cung cấp tùy chỉnh tường minh hoặc cài đặt yêu cầu hẹp như thời gian chờ.
OpenAI
- Nhà cung cấp:
openai - Xác thực:
OPENAI_API_KEY - Luân phiên không bắt buộc:
OPENAI_API_KEYS,OPENAI_API_KEY_1,OPENAI_API_KEY_2, cộng vớiOPENCLAW_LIVE_OPENAI_KEY(ghi đè duy nhất) - Mặc định khi thiết lập mới:
openai/gpt-5.6; trên API trực tiếp, mã trần phân giải thành Sol. - Mô hình ví dụ:
openai/gpt-5.6,openai/gpt-5.6-terra,openai/gpt-5.6-luna,openai/gpt-5.5 - Xác minh khả năng cung cấp tài khoản/mô hình bằng
openclaw models list --provider openainếu một bản cài đặt hoặc khóa API cụ thể hoạt động khác. - CLI:
openclaw onboard --auth-choice openai-api-key - Giao vận mặc định là
auto; OpenClaw chuyển lựa chọn giao vận đến môi trường thực thi mô hình dùng chung. - Ghi đè theo từng mô hình qua
agents.defaults.models["openai/<model>"].params.transport("sse","websocket"hoặc"auto") - Có thể bật xử lý ưu tiên OpenAI qua
agents.defaults.models["openai/<model>"].params.serviceTier /fastvàparams.fastModeánh xạ các yêu cầu Responsesopenai/*trực tiếp sangservice_tier=prioritytrênapi.openai.com- Sử dụng
params.serviceTierkhi bạn muốn một cấp tường minh thay vì nút bật/tắt/fastdùng chung - Các tiêu đề ghi công OpenClaw ẩn (
originator,version,User-Agent) chỉ áp dụng cho lưu lượng OpenAI gốc đếnapi.openai.com, không áp dụng cho proxy tương thích OpenAI chung - Các tuyến OpenAI gốc cũng giữ lại
storecủa Responses, gợi ý bộ nhớ đệm prompt và định hình tải trọng tương thích suy luận OpenAI; các tuyến proxy thì không openai/gpt-5.3-codex-sparkchỉ khả dụng qua OAuth ChatGPT/Codex; các tuyến khóa API OpenAI trực tiếp và khóa API Azure từ chối nó
openai/gpt-5.5 một cách tường minh. Quy trình thiết lập ban đầu và xác thực lại thông thường giữ nguyên
mô hình chính tường minh hiện có; models auth login --set-default và
models set là các đường dẫn thay thế có chủ đích.
Anthropic
- Nhà cung cấp:
anthropic - Xác thực:
ANTHROPIC_API_KEY - Luân phiên không bắt buộc:
ANTHROPIC_API_KEYS,ANTHROPIC_API_KEY_1,ANTHROPIC_API_KEY_2, cộng vớiOPENCLAW_LIVE_ANTHROPIC_KEY(ghi đè duy nhất) - Mô hình ví dụ:
anthropic/claude-opus-4-6 - CLI:
openclaw onboard --auth-choice apiKey - Các yêu cầu Anthropic công khai trực tiếp hỗ trợ nút bật/tắt
/fastdùng chung vàparams.fastMode, bao gồm lưu lượng được xác thực bằng khóa API và OAuth gửi đếnapi.anthropic.com; OpenClaw ánh xạ điều đó sangservice_tiercủa Anthropic (autoso vớistandard_only) - Cấu hình Claude CLI ưu tiên giữ tham chiếu mô hình ở dạng chính thức và chọn riêng
phần phụ trợ CLI:
anthropic/claude-opus-4-8vớiagentRuntime.id: "claude-cli"ở phạm vi mô hình. Các tham chiếuclaude-cli/claude-opus-4-7cũ vẫn hoạt động để đảm bảo khả năng tương thích.
Việc tái sử dụng Claude CLI (
claude -p) là một đường dẫn tích hợp OpenClaw được chấp thuận. Xác thực bằng token thiết lập Anthropic vẫn được hỗ trợ, nhưng OpenClaw ưu tiên tái sử dụng Claude CLI khi có sẵn.OAuth OpenAI ChatGPT/Codex
- Nhà cung cấp:
openai - Xác thực: OAuth (ChatGPT)
- Tham chiếu mới cho bộ kiểm thử app-server Codex nguyên bản:
openai/gpt-5.6-sol - Tài liệu về bộ kiểm thử app-server Codex nguyên bản: Bộ kiểm thử Codex
- Tham chiếu mô hình cũ:
codex/gpt-*,openai-codex/gpt-* - Ranh giới Plugin:
openai/*tải Plugin OpenAI; chính sách runtime tường minh hoặc tuyến hiệu lực do nhà cung cấp sở hữu quyết định có chọn Plugin app-server Codex nguyên bản hay không. - CLI:
openclaw onboard --auth-choice openaihoặcopenclaw models auth login --provider openai - Phương thức vận chuyển ChatGPT Responses nhúng của OpenClaw mặc định là
auto(ưu tiên WebSocket, dự phòng SSE). agents.defaults.models["openai/<model>"].params.transport,params.serviceTiervàparams.fastModelà các thiết lập yêu cầu nhúng do người dùng cấu hình. Chúng giữ việc lựa chọn runtime ngầm định trên OpenClaw; Codex nguyên bản sở hữu phương thức vận chuyển app-server và cấp dịch vụ của nó.- Các header ghi nhận OpenClaw ẩn (
originator,version,User-Agent) chỉ được đính kèm vào lưu lượng Codex nguyên bản tớichatgpt.com/backend-api, không áp dụng cho các proxy tương thích OpenAI nói chung - Nút chuyển đổi
/fastdùng chung vẫn khả dụng như một điều khiển runtime; nó khác với các tham số mô hình do người dùng cấu hình. - Danh mục Codex nguyên bản có thể cung cấp chính xác các tham chiếu
openai/gpt-5.6-sol,openai/gpt-5.6-terravàopenai/gpt-5.6-lunatùy theo quyền truy cập của tài khoản. Nó không áp dụng bí danh trầngpt-5.6của API trực tiếp ở phía máy khách. openai/gpt-5.5sử dụngcontextWindow = 400000nguyên bản trong danh mục Codex và runtime mặc địnhcontextTokens = 272000; ghi đè giới hạn runtime bằngmodels.providers.openai.models[].contextTokens- Đăng nhập bằng phương thức xác thực
openaivà sử dụngopenai/gpt-5.6-solcho một thiết lập mới dựa trên gói đăng ký. Chọn tường minhopenai/gpt-5.5nếu không gian làm việc Codex đó không cung cấp GPT-5.6. - Sử dụng nhà cung cấp/mô hình
agentRuntime.id: "openclaw"để giữ một tuyến vốn đủ điều kiện trên runtime tích hợp sẵn. Khi runtime chưa được đặt hoặc làauto, chỉ một tuyến Responses/ChatGPT chính thức tương thích HTTPS chính xác, không có ghi đè yêu cầu do người dùng cấu hình, mới có thể chọn Codex ngầm định. - Các tham chiếu GPT Codex cũ là trạng thái kế thừa, không phải tuyến nhà cung cấp đang hoạt động. Sử dụng các tham chiếu
openai/*chuẩn cho cấu hình tác nhân mới và chạyopenclaw doctor --fixđể di chuyển các tham chiếucodex/*vàopenai-codex/*trong khi vẫn giữ nguyên ngữ nghĩa Codex nguyên bản của chúng bằngagentRuntime.id: "codex"theo phạm vi mô hình. Các lựa chọnopenai/gpt-5.5chuẩn, tường minh hiện có sẽ không được nâng cấp.
Các tùy chọn lưu trữ dạng thuê bao khác
MiniMax
Quyền truy cập bằng OAuth hoặc khóa API của MiniMax Coding Plan.
Qwen Cloud
Giao diện nhà cung cấp Qwen Cloud cùng với ánh xạ điểm cuối Alibaba DashScope và Coding Plan.
Z.AI (GLM)
Coding Plan của Z.AI hoặc các điểm cuối API chung.
OpenCode
- Xác thực:
OPENCODE_API_KEY(hoặcOPENCODE_ZEN_API_KEY) - Nhà cung cấp runtime Zen:
opencode - Nhà cung cấp runtime Go:
opencode-go - Các mô hình ví dụ:
opencode/claude-opus-4-6,opencode-go/kimi-k2.6 - CLI:
openclaw onboard --auth-choice opencode-zenhoặcopenclaw onboard --auth-choice opencode-go
Google Gemini (khóa API)
- Nhà cung cấp:
google - Xác thực:
GEMINI_API_KEY - Luân phiên tùy chọn:
GEMINI_API_KEYS,GEMINI_API_KEY_1,GEMINI_API_KEY_2, dự phòngGOOGLE_API_KEYvàOPENCLAW_LIVE_GEMINI_KEY(ghi đè đơn) - Các mô hình ví dụ:
google/gemini-3.1-pro-preview,google/gemini-3.5-flash - Khả năng tương thích: cấu hình OpenClaw cũ sử dụng
google/gemini-3.1-flash-previewđược chuẩn hóa thànhgoogle/gemini-3-flash-preview - Bí danh:
google/gemini-3.1-prođược chấp nhận và chuẩn hóa thành mã định danh API Gemini đang hoạt động của Google,google/gemini-3.1-pro-preview - CLI:
openclaw onboard --auth-choice gemini-api-key - Suy luận:
/think adaptivesử dụng cơ chế suy luận động của Google. Gemini 3/3.1 bỏ quathinkingLevelcố định; Gemini 2.5 gửithinkingBudget: -1. - Các lần chạy Gemini trực tiếp cũng chấp nhận
agents.defaults.models["google/<model>"].params.cachedContent(hoặccached_contentcũ) để chuyển tiếp handlecachedContents/...nguyên bản của nhà cung cấp; các lượt truy cập bộ nhớ đệm Gemini được hiển thị dưới dạngcacheReadcủa OpenClaw
Google Vertex và Gemini CLI
- Các nhà cung cấp:
google-vertex,google-gemini-cli - Xác thực: Vertex sử dụng gcloud ADC; Gemini CLI sử dụng luồng OAuth của nó
google đi kèm.
1
Cài đặt Gemini CLI
- brew
- npm
2
Bật Plugin
3
Đăng nhập
google-gemini-cli/gemini-3-flash-preview. Bạn không dán mã định danh máy khách hoặc thông tin bí mật vào openclaw.json. Luồng đăng nhập CLI lưu trữ token trong các hồ sơ xác thực trên máy chủ Gateway.4
Đặt dự án (nếu cần)
Nếu các yêu cầu thất bại sau khi đăng nhập, hãy đặt
GOOGLE_CLOUD_PROJECT hoặc GOOGLE_CLOUD_PROJECT_ID trên máy chủ Gateway.stream-json theo mặc định. OpenClaw đọc các thông báo luồng
của trợ lý và chuẩn hóa stats.cached thành cacheRead; các ghi đè
--output-format json cũ vẫn đọc văn bản trả lời từ response.
Z.AI (GLM)
- Nhà cung cấp:
zai - Xác thực:
ZAI_API_KEY - Mô hình ví dụ:
zai/glm-5.2 - CLI:
openclaw onboard --auth-choice zai-api-key- Các tham chiếu mô hình sử dụng mã định danh nhà cung cấp
zai/*chuẩn. zai-api-keytự động phát hiện điểm cuối Z.AI tương ứng;zai-coding-global,zai-coding-cn,zai-globalvàzai-cnbuộc sử dụng một giao diện cụ thể
- Các tham chiếu mô hình sử dụng mã định danh nhà cung cấp
Vercel AI Gateway
- Nhà cung cấp:
vercel-ai-gateway - Xác thực:
AI_GATEWAY_API_KEY - Các mô hình ví dụ:
vercel-ai-gateway/anthropic/claude-opus-4.6,vercel-ai-gateway/moonshotai/kimi-k2.6 - CLI:
openclaw onboard --auth-choice ai-gateway-api-key
Các Plugin nhà cung cấp đi kèm khác
Những điểm đặc thù cần biết
OpenRouter
OpenRouter
Chỉ áp dụng các header ghi nhận ứng dụng và marker Anthropic
cache_control trên các tuyến openrouter.ai đã được xác minh. Các tham chiếu DeepSeek, Moonshot và ZAI đủ điều kiện sử dụng TTL bộ nhớ đệm cho việc lưu bộ nhớ đệm prompt do OpenRouter quản lý, nhưng không nhận marker bộ nhớ đệm Anthropic. Vì là một đường dẫn kiểu proxy tương thích với OpenAI, nó bỏ qua việc định dạng chỉ dành cho OpenAI gốc (serviceTier, Responses store, gợi ý bộ nhớ đệm prompt, khả năng tương thích suy luận OpenAI). Các tham chiếu dựa trên Gemini chỉ giữ lại quy trình làm sạch chữ ký suy nghĩ proxy-Gemini.Kilo Gateway
Kilo Gateway
Các tham chiếu dựa trên Gemini sử dụng cùng quy trình làm sạch proxy-Gemini;
kilocode/kilo-auto/balanced và các tham chiếu khác không hỗ trợ suy luận qua proxy sẽ bỏ qua việc chèn suy luận proxy.MiniMax
MiniMax
Quy trình thiết lập bằng khóa API ghi các định nghĩa mô hình trò chuyện M3 và M2.7 tường minh; khả năng hiểu hình ảnh vẫn sử dụng nhà cung cấp phương tiện
MiniMax-VL-01 do plugin sở hữu.NVIDIA
NVIDIA
ID mô hình sử dụng không gian tên
nvidia/<vendor>/<model> (ví dụ: nvidia/nvidia/nemotron-...); bộ chọn giữ nguyên cấu trúc <provider>/<model-id> theo nghĩa đen, trong khi khóa chính tắc gửi đến API vẫn chỉ có một tiền tố.xAI
xAI
Sử dụng đường dẫn Responses của xAI. Đường dẫn được khuyến nghị là OAuth SuperGrok/X Premium; khóa API vẫn hoạt động qua
XAI_API_KEY hoặc cấu hình plugin, và Grok web_search sử dụng lại cùng hồ sơ xác thực trước khi dự phòng sang khóa API. Có thể chọn Grok 4.5 cho trò chuyện, lập trình và công việc tác tử khi khả dụng; grok-4.3 vẫn là giá trị mặc định đi kèm an toàn theo khu vực. Các cấu hình /fast và params.fastMode: true cũ hơn vẫn được phân giải qua chuyển hướng tương thích Grok 4.3 của xAI, nhưng cấu hình mới nên chọn trực tiếp một mô hình hiện hành. tool_stream được bật theo mặc định; tắt bằng agents.defaults.models["xai/<model>"].params.tool_stream=false.Nhà cung cấp qua models.providers (URL tùy chỉnh/cơ sở)
Sử dụng models.providers (hoặc models.json) để thêm nhà cung cấp tùy chỉnh hoặc proxy tương thích với OpenAI/Anthropic.
Nhiều plugin nhà cung cấp đi kèm bên dưới đã công bố danh mục mặc định. Chỉ sử dụng các mục models.providers.<id> tường minh khi muốn ghi đè URL cơ sở, header hoặc danh sách mô hình mặc định.
Các bước kiểm tra khả năng mô hình của Gateway cũng đọc siêu dữ liệu models.providers.<id>.models[] tường minh. Nếu một mô hình tùy chỉnh hoặc proxy chấp nhận hình ảnh, hãy đặt input: ["text", "image"] trên mô hình đó để các đường dẫn tệp đính kèm từ WebChat và node truyền hình ảnh dưới dạng đầu vào mô hình gốc thay vì tham chiếu phương tiện chỉ có văn bản.
agents.defaults.models["provider/model"] kiểm soát bí danh và siêu dữ liệu theo từng mô hình cho tác tử. Bản thân nó không hạn chế việc ghi đè cũng không đăng ký mô hình runtime mới. Đối với mô hình của nhà cung cấp tùy chỉnh, cũng thêm models.providers.<provider>.models[] với ít nhất id tương ứng; sử dụng riêng agents.defaults.modelPolicy.allow khi muốn hạn chế việc ghi đè.
Moonshot AI (Kimi)
Cài đặt@openclaw/moonshot-provider trước khi thiết lập. Chỉ thêm mục models.providers.moonshot tường minh khi cần ghi đè URL cơ sở hoặc siêu dữ liệu mô hình:
- Nhà cung cấp:
moonshot - Xác thực:
MOONSHOT_API_KEY - Mô hình ví dụ:
moonshot/kimi-k3 - CLI:
openclaw onboard --auth-choice moonshot-api-keyhoặcopenclaw onboard --auth-choice moonshot-api-key-cn
moonshot/kimi-k2.6moonshot/kimi-k3moonshot/kimi-k2.7-codemoonshot/kimi-k2.7-code-highspeedmoonshot/kimi-k2.5
Kimi Coding
Kimi Coding sử dụng endpoint tương thích với Anthropic của Moonshot AI:- Nhà cung cấp:
kimi - Xác thực:
KIMI_API_KEY - Kimi K3:
kimi/k3(256K) hoặckimi/k3[1m](gói 1M) - Kimi Code:
kimi/kimi-for-coding - Kimi Code HighSpeed:
kimi/kimi-for-coding-highspeed
kimi/kimi-code và kimi/k2p5 cũ vẫn được chấp nhận dưới dạng ID mô hình tương thích và được chuẩn hóa thành ID mô hình API ổn định của Kimi.
Volcano Engine (Doubao)
Volcano Engine (火山引擎) cung cấp quyền truy cập vào Doubao và các mô hình khác tại Trung Quốc.- Nhà cung cấp:
volcengine(lập trình:volcengine-plan) - Xác thực:
VOLCANO_ENGINE_API_KEY - Mô hình ví dụ:
volcengine-plan/ark-code-latest - CLI:
openclaw onboard --auth-choice volcengine-api-key
volcengine/* chung được đăng ký cùng lúc.
Trong bộ chọn mô hình khi thiết lập/cấu hình, lựa chọn xác thực Volcengine ưu tiên cả hai hàng volcengine/* và volcengine-plan/*. Nếu các mô hình đó chưa được tải, OpenClaw sẽ dự phòng sang danh mục chưa lọc thay vì hiển thị một bộ chọn trống giới hạn theo nhà cung cấp.
- Mô hình tiêu chuẩn
- Mô hình lập trình (volcengine-plan)
volcengine/doubao-seed-1-8-251228(Doubao Seed 1.8)volcengine/doubao-seed-code-preview-251028volcengine/kimi-k2-5-260127(Kimi K2.5)volcengine/glm-4-7-251222(GLM 4.7)volcengine/deepseek-v3-2-251201(DeepSeek V3.2)
BytePlus (Quốc tế)
BytePlus ARK cung cấp quyền truy cập vào cùng các mô hình như Volcano Engine cho người dùng quốc tế.- Nhà cung cấp:
byteplus(lập trình:byteplus-plan) - Xác thực:
BYTEPLUS_API_KEY - Mô hình ví dụ:
byteplus-plan/ark-code-latest - CLI:
openclaw onboard --auth-choice byteplus-api-key
byteplus/* chung cũng được đăng ký cùng lúc.
Trong bộ chọn mô hình của quy trình thiết lập ban đầu/cấu hình, lựa chọn xác thực BytePlus ưu tiên cả các hàng byteplus/* và byteplus-plan/*. Nếu các mô hình đó chưa được tải, OpenClaw sẽ chuyển sang danh mục chưa lọc thay vì hiển thị bộ chọn theo phạm vi nhà cung cấp trống.
- Mô hình tiêu chuẩn
- Mô hình lập trình (byteplus-plan)
byteplus/seed-1-8-251228(Seed 1.8)byteplus/kimi-k2-5-260127(Kimi K2.5)byteplus/glm-4-7-251222(GLM 4.7)
Synthetic
Synthetic cung cấp các mô hình tương thích với Anthropic thông qua nhà cung cấpsynthetic:
- Nhà cung cấp:
synthetic - Xác thực:
SYNTHETIC_API_KEY - Mô hình ví dụ:
synthetic/hf:MiniMaxAI/MiniMax-M3 - CLI:
openclaw onboard --auth-choice synthetic-api-key
MiniMax
MiniMax được cấu hình quamodels.providers vì sử dụng các điểm cuối tùy chỉnh:
- MiniMax OAuth (Toàn cầu):
--auth-choice minimax-global-oauth - MiniMax OAuth (CN):
--auth-choice minimax-cn-oauth - Khóa API MiniMax (Toàn cầu):
--auth-choice minimax-global-api - Khóa API MiniMax (CN):
--auth-choice minimax-cn-api - Xác thực:
MINIMAX_API_KEYchominimax;MINIMAX_OAUTH_TOKENhoặcMINIMAX_API_KEYchominimax-portal
Trên đường truyền trực tuyến tương thích với Anthropic của MiniMax, OpenClaw mặc định tắt chế độ suy luận cho dòng M2.x trừ khi bạn thiết lập rõ ràng; MiniMax-M3 (và M3.x) mặc định vẫn sử dụng đường dẫn suy luận bỏ qua/thích ứng của nhà cung cấp.
/fast on ghi lại MiniMax-M2.7 thành MiniMax-M2.7-highspeed.- Mặc định văn bản/trò chuyện vẫn dùng
minimax/MiniMax-M3 - Tạo hình ảnh là
minimax/image-01hoặcminimax-portal/image-01 - Hiểu hình ảnh là
MiniMax-VL-01do Plugin sở hữu trên cả hai đường dẫn xác thực MiniMax - Tìm kiếm web vẫn dùng ID nhà cung cấp
minimax
LM Studio
LM Studio được cung cấp dưới dạng Plugin nhà cung cấp tích hợp sẵn sử dụng API gốc:- Nhà cung cấp:
lmstudio - Xác thực:
LM_API_TOKEN - URL cơ sở suy luận mặc định:
http://localhost:1234/v1
http://localhost:1234/api/v1/models trả về):
/api/v1/models và /api/v1/models/load gốc của LM Studio để khám phá + tự động tải, với /v1/chat/completions dùng cho suy luận theo mặc định. Nếu bạn muốn tính năng tải JIT, TTL và tự động loại bỏ của LM Studio quản lý vòng đời mô hình, hãy thiết lập models.providers.lmstudio.params.preload: false. Xem /providers/lmstudio để biết cách thiết lập và khắc phục sự cố.
Ollama
Ollama được cung cấp dưới dạng Plugin nhà cung cấp tích hợp sẵn và sử dụng API gốc của Ollama:- Nhà cung cấp:
ollama - Xác thực: Không bắt buộc (máy chủ cục bộ)
- Mô hình ví dụ:
ollama/llama3.3 - Cài đặt: https://ollama.com/download
http://127.0.0.1:11434 khi bạn chọn tham gia bằng OLLAMA_API_KEY, và Plugin nhà cung cấp tích hợp sẵn thêm Ollama trực tiếp vào openclaw onboard và bộ chọn mô hình. Xem /providers/ollama để biết về quy trình thiết lập ban đầu, chế độ đám mây/cục bộ và cấu hình tùy chỉnh.
vLLM
vLLM được cung cấp dưới dạng Plugin nhà cung cấp tích hợp sẵn dành cho các máy chủ cục bộ/tự lưu trữ tương thích với OpenAI:- Nhà cung cấp:
vllm - Xác thực: Tùy chọn (phụ thuộc vào máy chủ của bạn)
- URL cơ sở mặc định:
http://127.0.0.1:8000/v1
/v1/models trả về):
SGLang
SGLang được cung cấp dưới dạng Plugin nhà cung cấp tích hợp sẵn dành cho các máy chủ tự lưu trữ nhanh, tương thích với OpenAI:- Nhà cung cấp:
sglang - Xác thực: Tùy chọn (phụ thuộc vào máy chủ của bạn)
- URL cơ sở mặc định:
http://127.0.0.1:30000/v1
/v1/models trả về):
Proxy cục bộ (LM Studio, vLLM, LiteLLM, v.v.)
Ví dụ (tương thích với OpenAI):Các trường tùy chọn mặc định
Các trường tùy chọn mặc định
Đối với nhà cung cấp tùy chỉnh,
reasoning, input, cost, contextWindow và maxTokens là tùy chọn. Khi bị bỏ qua, OpenClaw mặc định sử dụng:reasoning: falseinput: ["text"]cost: { input: 0, output: 0, cacheRead: 0, cacheWrite: 0 }contextWindow: 200000maxTokens: 8192
Quy tắc định hình tuyến proxy
Quy tắc định hình tuyến proxy
- Đối với
api: "openai-completions"trên các điểm cuối không phải gốc (bất kỳbaseUrlkhông trống nào có máy chủ không phảiapi.openai.com), OpenClaw buộccompat.supportsDeveloperRole: falseđể tránh lỗi 400 từ nhà cung cấp đối với các vai tròdeveloperkhông được hỗ trợ. - Các tuyến tương thích với OpenAI kiểu proxy cũng bỏ qua việc định hình yêu cầu chỉ dành cho OpenAI gốc: không có
service_tier, không có Responsesstore, không có Completionsstore, không có gợi ý bộ nhớ đệm prompt, không định hình tải trọng tương thích suy luận OpenAI và không có tiêu đề ghi công OpenClaw ẩn. - Đối với các proxy Completions tương thích với OpenAI cần trường dành riêng cho nhà cung cấp, hãy thiết lập
agents.defaults.models["provider/model"].params.extra_body(hoặcextraBody) để hợp nhất JSON bổ sung vào phần thân yêu cầu gửi đi. - Đối với các điều khiển mẫu trò chuyện của vLLM, hãy thiết lập
agents.defaults.models["provider/model"].params.chat_template_kwargs. Plugin vLLM tích hợp sẵn tự động gửienable_thinking: falsevàforce_nonempty_content: truechovllm/nemotron-3-*khi mức suy luận của phiên bị tắt. - Đối với các mô hình cục bộ chậm hoặc máy chủ LAN/tailnet từ xa, hãy thiết lập
models.providers.<id>.timeoutSeconds. Điều này kéo dài quá trình xử lý yêu cầu HTTP mô hình của nhà cung cấp, bao gồm kết nối, tiêu đề, truyền trực tuyến phần thân và thao tác hủy guarded-fetch tổng thể, mà không tăng thời gian chờ của toàn bộ thời gian chạy tác nhân. Nếuagents.defaults.timeoutSecondshoặc thời gian chờ dành riêng cho lượt chạy thấp hơn, hãy tăng cả giới hạn đó; thời gian chờ của nhà cung cấp không thể kéo dài toàn bộ lượt chạy. - Các lệnh gọi HTTP đến nhà cung cấp mô hình chỉ cho phép câu trả lời DNS fake-IP của Surge, Clash và sing-box trong
198.18.0.0/15vàfc00::/7đối với tên máy chủbaseUrlcủa nhà cung cấp đã cấu hình. Các điểm cuối nhà cung cấp tùy chỉnh/cục bộ cũng tin cậy chính xác nguồn gốcscheme://host:portđã cấu hình đó cho các yêu cầu mô hình được bảo vệ, bao gồm các máy chủ loopback, LAN và tailnet. Đây không phải là tùy chọn cấu hình mới;baseUrlbạn cấu hình chỉ mở rộng chính sách yêu cầu cho nguồn gốc đó. Việc cho phép tên máy chủ fake-IP và tin cậy chính xác nguồn gốc là các cơ chế độc lập. Các đích riêng tư, loopback, link-local, metadata khác và các cổng khác vẫn yêu cầu chọn tham giamodels.providers.<id>.request.allowPrivateNetwork: truerõ ràng. Thiết lậpmodels.providers.<id>.request.allowPrivateNetwork: falseđể từ chối tin cậy chính xác nguồn gốc. - Nếu
baseUrltrống/bị bỏ qua, OpenClaw giữ hành vi OpenAI mặc định (phân giải thànhapi.openai.com). - Để đảm bảo an toàn,
compat.supportsDeveloperRole: trueđược thiết lập rõ ràng vẫn bị ghi đè trên các điểm cuốiopenai-completionskhông phải gốc. - Đối với
api: "anthropic-messages"trên các điểm cuối không trực tiếp (bất kỳ nhà cung cấp nào ngoàianthropicchuẩn, hoặcmodels.providers.anthropic.baseUrltùy chỉnh có máy chủ không phải điểm cuốiapi.anthropic.comcông khai), OpenClaw loại bỏ các tiêu đề beta Anthropic ngầm định nhưclaude-code-20250219,interleaved-thinking-2025-05-14và các dấu hiệu OAuth để các proxy tùy chỉnh tương thích với Anthropic không từ chối cờ beta không được hỗ trợ. Hãy thiết lập rõ ràngmodels.providers.<id>.headers["anthropic-beta"]nếu proxy của bạn cần các tính năng beta cụ thể.
Ví dụ CLI
Liên quan
- Tham chiếu cấu hình - các khóa cấu hình mô hình
- Chuyển đổi dự phòng mô hình - chuỗi dự phòng và hành vi thử lại
- Mô hình - cấu hình mô hình và bí danh
- Nhà cung cấp - hướng dẫn thiết lập cho từng nhà cung cấp