zai với khóa API Z.AI.
Các mô hình GLM
GLM là một họ mô hình, không phải một nhà cung cấp riêng biệt. Trong OpenClaw, các mô hình GLM sử dụng tham chiếu nhưzai/glm-5.2: nhà cung cấp zai, mã mô hình glm-5.2.
Bắt đầu
Trước tiên, hãy cài đặt Plugin nhà cung cấp:- Tự động phát hiện điểm cuối
- Chỉ định rõ điểm cuối theo khu vực
Phù hợp nhất cho: hầu hết người dùng. OpenClaw thăm dò các điểm cuối Z.AI được hỗ trợ bằng khóa API của bạn và tự động áp dụng URL cơ sở chính xác.
1
Chạy quy trình thiết lập ban đầu
2
Xác minh mô hình xuất hiện trong danh sách
Điểm cuối
Z.AI cũng công bố URL cơ sở Coding Plan tương thích với Anthropic
https://api.z.ai/api/anthropic. Các tùy chọn Z.AI của OpenClaw sử dụng
các điểm cuối OpenAI Chat Completions được ghi lại ở trên; URL Anthropic dành cho các máy khách
giao tiếp trực tiếp bằng Anthropic Messages.
zai-api-key tự động phát hiện một trong bốn điểm cuối này bằng cách thăm dò khóa của bạn với API
chat-completions của từng điểm cuối, kiểm tra các điểm cuối chung (zai-global,
sau đó zai-cn) trước các điểm cuối Coding Plan (zai-coding-global, sau đó
zai-coding-cn), rồi dừng tại điểm cuối đầu tiên chấp nhận yêu cầu.
Hãy sử dụng --auth-choice rõ ràng để buộc dùng một điểm cuối Coding Plan nếu khóa của bạn
hoạt động trên cả hai loại.
Giới hạn tốc độ và tình trạng quá tải
Z.AI mô tả Coding Plan và các công cụ tác nhân đa dụng là những dịch vụ được quản lý theo năng lực. Theo tài liệu của chính Z.AI:- Các công cụ tác nhân đa dụng, bao gồm OpenClaw, được phục vụ theo khả năng tốt nhất. Trong thời gian tải suy luận cao, thường vào khoảng 2-6 giờ chiều theo giờ Singapore, một số yêu cầu có thể gặp giới hạn tốc độ tạm thời.
- Giới hạn tốc độ và số yêu cầu đồng thời của Coding Plan phụ thuộc vào cấp gói và có thể được điều chỉnh linh hoạt dựa trên tài nguyên sẵn có. Ngoài giờ cao điểm có thể cho phép số yêu cầu đồng thời cao hơn.
- Mã lỗi API
1302có nghĩa là “Đã đạt giới hạn tốc độ yêu cầu”. Mã lỗi API1305có nghĩa là “Dịch vụ có thể đang tạm thời quá tải, vui lòng thử lại sau”.
429 hoặc 1305 tạm thời trong thời gian bận, hãy chờ rồi
thử lại yêu cầu. Nếu lỗi lặp lại ngoài giờ cao điểm hoặc chỉ
xảy ra với một điểm cuối, mô hình hay cấu trúc yêu cầu, trước tiên hãy kiểm tra điểm cuối
và mô hình đã cấu hình:
https://api.z.ai/api/coding/paas/v4; khóa API chung phải sử dụng điểm cuối API chung
như https://api.z.ai/api/paas/v4. Lỗi kéo dài với cùng một khóa và điểm cuối
có thể cho thấy nhà cung cấp từ chối hoặc gói có giới hạn,
không phải điều tiết tải cao điểm thông thường.
Ví dụ cấu hình
Danh mục tích hợp sẵn
Plugin nhà cung cấpzai cung cấp danh mục của mình trong bản kê khai Plugin, vì vậy thao tác
liệt kê chỉ đọc có thể hiển thị các hàng GLM đã biết mà không cần tải môi trường thời gian chạy của nhà cung cấp:
Siêu dữ liệu chi phí token của danh mục tuân theo
giá trả theo mức sử dụng hiện tại của Z.AI. Các gói đăng ký Coding Plan
sử dụng hạn ngạch gói thay vì tính phí theo token; hãy xem
trang đăng ký trực tiếp để biết giá và khả năng cung cấp của gói.
Thiết lập Coding Plan mặc định là
zai/glm-5.2; thiết lập API chung giữ nguyên
zai/glm-5.1. Trên các điểm cuối Coding Plan, tính năng tự động phát hiện sẽ chuyển sang
glm-5.1 rồi glm-4.7 khi khóa/gói không cung cấp GLM-5.2. Các phiên bản
và khả năng cung cấp GLM có thể thay đổi; hãy chạy openclaw models list --all --provider zai
để xem danh mục mà phiên bản bạn đã cài đặt nhận biết.Mức độ suy luận
- GLM-5.2
- Các mô hình GLM khác
Toàn bộ phạm vi:
off, low, high, max (mặc định off). OpenClaw ánh xạ
low và high sang mức nỗ lực suy luận high của Z.AI, còn max sang
mức nỗ lực max của Z.AI, thông qua reasoning_effort trong tải trọng yêu cầu.off giúp tránh các phản hồi sử dụng hết ngân sách đầu ra cho
reasoning_content trước khi có văn bản hiển thị.
Cấu hình nâng cao
Phân giải chuyển tiếp các mô hình GLM-5 chưa biết
Phân giải chuyển tiếp các mô hình GLM-5 chưa biết
Các mã
glm-5* chưa biết vẫn được phân giải chuyển tiếp trên đường dẫn nhà cung cấp bằng cách
tổng hợp siêu dữ liệu do nhà cung cấp sở hữu từ mẫu glm-4.7 khi mã
khớp với cấu trúc họ GLM-5 hiện tại.Truyền phát lệnh gọi công cụ
Truyền phát lệnh gọi công cụ
tool_stream được bật theo mặc định cho tính năng truyền phát lệnh gọi công cụ của Z.AI. Để tắt tính năng này:Duy trì quá trình suy luận
Duy trì quá trình suy luận
Việc duy trì quá trình suy luận là tùy chọn vì Z.AI yêu cầu phát lại toàn bộ
Khi được bật và chế độ suy luận đang hoạt động, OpenClaw sẽ gửi
reasoning_content trước đó, làm tăng số token lời nhắc. Bật tính năng này
theo từng mô hình:thinking: { type: "enabled", clear_thinking: false } và phát lại
reasoning_content trước đó cho cùng một bản ghi hội thoại tương thích với OpenAI. Khóa tham số dạng snake_case
preserve_thinking hoạt động như một bí danh.Người dùng nâng cao vẫn có thể ghi đè tải trọng chính xác của nhà cung cấp bằng
params.extra_body.thinking.Hiểu hình ảnh
Hiểu hình ảnh
Plugin Z.AI đăng ký khả năng hiểu hình ảnh.
Khả năng hiểu hình ảnh được tự động phân giải từ thông tin xác thực Z.AI đã cấu hình —
không cần cấu hình bổ sung.
Chi tiết xác thực
Chi tiết xác thực
- Z.AI sử dụng xác thực Bearer với khóa API của bạn.
- Tùy chọn thiết lập ban đầu
zai-api-keytự động phát hiện điểm cuối Z.AI phù hợp bằng cách thăm dò các điểm cuối được hỗ trợ với khóa của bạn. - Hãy sử dụng các tùy chọn khu vực rõ ràng (
zai-coding-global,zai-coding-cn,zai-global,zai-cn) khi bạn muốn buộc sử dụng một bề mặt API cụ thể. - Biến môi trường cũ
Z_AI_API_KEYvẫn được chấp nhận; OpenClaw sao chép biến này sangZAI_API_KEYkhi khởi động nếuZAI_API_KEYchưa được đặt.
Liên quan
Lựa chọn mô hình
Chọn nhà cung cấp, tham chiếu mô hình và hành vi chuyển đổi dự phòng.
Tham chiếu cấu hình
Lược đồ cấu hình OpenClaw đầy đủ, bao gồm các thiết lập nhà cung cấp và mô hình.