openai, cho cả xác thực trực tiếp bằng khóa API và
xác thực bằng gói đăng ký ChatGPT/Codex. openai/* là tuyến mô hình chuẩn.
Đối với các lượt tác tử nhúng có chính sách runtime chưa được đặt hoặc là auto, các
thông tin tuyến của OpenAI quyết định liệu OpenClaw có thể ngầm chọn runtime
máy chủ ứng dụng Codex đi kèm hay không. Chỉ riêng tiền tố openai/* không chọn runtime.
- Mô hình tác tử -
openai/*thông qua runtime được chọn bởi cấu hìnhagentRuntimerõ ràng hoặc chính sách tuyến ngầm định của OpenAI. Đăng nhập bằng xác thực Codex để sử dụng gói đăng ký ChatGPT/Codex, hoặc cấu hình hồ sơ xác thực bằng khóa API khi bạn muốn thanh toán dựa trên khóa. - API OpenAI không dành cho tác tử - truy cập trực tiếp OpenAI Platform, tính phí theo mức sử dụng,
thông qua
OPENAI_API_KEYhoặc hồ sơ xác thực bằng khóa APIopenai. - Cấu hình cũ - các tham chiếu
codex/*vàopenai-codex/*đượcopenclaw doctor --fixsửa thànhopenai/*cùng vớiagentRuntime.id: "codex"có phạm vi theo mô hình.
Theo dõi mức sử dụng và chi phí
OpenClaw tách biệt hạn ngạch gói đăng ký với việc tính phí API Platform:- OAuth ChatGPT/Codex hiển thị gói đăng ký, các khoảng hạn ngạch và số dư tín dụng.
OPENAI_ADMIN_KEYhiển thị 30 ngày chi phí tổ chức và mức sử dụng lượt hoàn thành do nhà cung cấp báo cáo trong mục Mức sử dụng của Control UI, bao gồm chi tiêu hằng ngày, tổng số yêu cầu/token, các mô hình hàng đầu và các danh mục chi phí.OPENAI_PROJECT_IDcó thể giới hạn lịch sử Admin API trong một dự án.- OpenClaw không bao giờ gửi
OPENAI_API_KEYhoặc hồ sơ suy luậnopenaiđến các API của tổ chức; những thông tin xác thực đó có thể thuộc về các điểm cuối tùy chỉnh, Azure hoặc cục bộ của tác tử.
Lựa chọn nhanh
Bản đồ tên gọi
Runtime tác tử ngầm định
Khi chính sáchagentRuntime của nhà cung cấp/mô hình chưa được đặt hoặc là auto, chính sách
tuyến do nhà cung cấp OpenAI sở hữu sẽ chọn runtime ngầm định dựa trên
điểm cuối và bộ điều hợp có hiệu lực:
agentRuntime.id không mặc định và được chỉ định rõ ràng của nhà cung cấp/mô hình vẫn có thẩm quyền quyết định.
Ví dụ, agentRuntime.id: "openclaw" giữ một tuyến vốn đủ điều kiện dùng Codex
trên OpenClaw, trong khi agentRuntime.id: "codex" yêu cầu Codex và từ chối
khi tuyến có hiệu lực không được khai báo là tương thích với Codex.
Việc chọn runtime không thay đổi loại thông tin xác thực hoặc cách tính phí: xác thực
bằng khóa API Platform và xác thực bằng gói đăng ký ChatGPT/Codex vẫn tách biệt.
openclaw doctor --fix di chuyển các tham chiếu mô hình codex/* và openai-codex/*
cũ, id hồ sơ xác thực Codex cũ và các mục thứ tự xác thực Codex cũ sang
tuyến chuẩn openai. Các tham chiếu mô hình đã di chuyển nhận
agentRuntime.id: "codex" có phạm vi theo mô hình; dùng auth.order.openai cho cấu hình thứ tự xác thực mới.
Thiết lập OpenAI mới chỉ áp dụng GPT-5.6 làm mô hình chính khi chưa cấu hình
mô hình chính. Việc thêm hoặc làm mới xác thực OpenAI giữ nguyên lựa chọn rõ ràng
hiện có, bao gồm
openai/gpt-5.5, trừ khi bạn sử dụng rõ ràng
models auth login --set-default hoặc models set. Chỉ sử dụng hồ sơ xác thực
bằng khóa API khi bạn muốn xác thực bằng khóa API cho một mô hình tác tử.Bản xem trước giới hạn của GPT-5.6
OpenClaw nhận dạng chính xác các id mô hìnhopenai/gpt-5.6-sol,
openai/gpt-5.6-terra và openai/gpt-5.6-luna. Cả ba đều cung cấp
khả năng suy luận xhigh và max trong danh mục hiện tại. OpenAI mô tả Sol là
tầng chủ lực, Terra là tầng cân bằng và Luna là tầng nhanh,
có chi phí thấp hơn. Xem
thông báo ra mắt GPT-5.6
và hướng dẫn truy cập.
Với xác thực trực tiếp bằng khóa API OpenAI, id openai/gpt-5.6 không định danh là bí danh của
Sol và là mặc định cho thiết lập mới. Danh mục Codex gốc không áp dụng
bí danh API trực tiếp đó ở phía máy khách; tùy theo quyền truy cập không gian làm việc, danh mục có thể hiển thị
chính xác các id Sol, Terra và Luna. Vì vậy, thiết lập OAuth ChatGPT/Codex mới
sử dụng openai/gpt-5.6-sol. Kiểm tra tài khoản hiện tại bằng:
Các tuyến HTTPS chính thức chính xác và đủ điều kiện có thể chọn Plugin máy chủ ứng dụng
Codex đi kèm khi chính sách runtime chưa được đặt hoặc là
auto; các tuyến Completions do người dùng tạo,
điểm cuối tùy chỉnh và ghi đè truyền tải yêu cầu vẫn chạy trên OpenClaw. Các
điểm cuối HTTP chính thức dạng văn bản thuần bị từ chối. Cấu hình runtime rõ ràng của nhà cung cấp/mô hình vẫn
có thẩm quyền quyết định. Chạy openclaw doctor --fix để sửa các tham chiếu mô hình Codex cũ,
tham chiếu codex-cli/* hoặc các ghim phiên runtime cũ không được đặt bởi
cấu hình runtime rõ ràng.Phạm vi hỗ trợ tính năng của OpenClaw
Giọng nói OpenAI Realtime đi qua OpenAI Platform Realtime
API công khai và yêu cầu khóa API Platform. Thay vào đó, token Codex OAuth xác thực
phần phụ trợ ChatGPT Codex; chúng không thể dùng thay thế cho khóa API Platform
trên các endpoint Realtime công khai.Nếu xác thực bằng khóa API báo thiếu thông tin thanh toán, hãy nạp thêm tín dụng Platform tại
platform.openai.com/account/billing
cho tổ chức hỗ trợ thông tin xác thực thời gian thực của bạn khi sử dụng phương thức xác thực bằng khóa API.
Giọng nói thời gian thực chấp nhận hồ sơ xác thực bằng khóa API
openai được tạo bởi
openclaw onboard --auth-choice openai-api-key, khóa API Platform được đặt qua
talk.realtime.providers.openai.apiKey cho Control UI Talk, hoặc
plugins.entries.voice-call.config.realtime.providers.openai.apiKey cho Voice
Call, hoặc biến môi trường OPENAI_API_KEY.Trong Control UI Video Talk, OpenAI WebRTC nhận ngữ cảnh camera theo yêu cầu:
khi mô hình gọi describe_view, trình duyệt gửi một ảnh JPEG có kích thước giới hạn qua
kênh dữ liệu thời gian thực. OpenClaw không đính kèm luồng camera liên tục
vào phiên OpenAI.Embedding bộ nhớ
OpenClaw có thể dùng OpenAI hoặc endpoint embedding tương thích với OpenAI để lập chỉ mụcmemory_search và tạo embedding truy vấn:
queryInputType và documentInputType trong memorySearch. OpenClaw
chuyển tiếp chúng dưới dạng các trường yêu cầu input_type dành riêng cho nhà cung cấp: embedding
truy vấn dùng queryInputType; các đoạn bộ nhớ đã lập chỉ mục và quá trình lập chỉ mục theo lô dùng
documentInputType. Xem
Tham chiếu cấu hình bộ nhớ
để biết ví dụ đầy đủ.
Bắt đầu
- Khóa API (OpenAI Platform)
- Thuê bao Codex
Phù hợp nhất cho: truy cập API trực tiếp và thanh toán theo mức sử dụng.Hoặc truyền trực tiếp khóa:ID
1
Lấy khóa API
Tạo hoặc sao chép khóa API từ bảng điều khiển OpenAI Platform.
2
Chạy quy trình thiết lập ban đầu
3
Xác minh mô hình khả dụng
Tóm tắt tuyến
Khi runtime chưa được đặt hoặc là
auto, chỉ tuyến gốc HTTPS chính thức khớp chính xác
và đủ điều kiện mới có thể ngầm chọn trình chạy app-server Codex. Để xác thực bằng khóa API
trên mô hình tác tử, hãy tạo hồ sơ xác thực bằng khóa API openai và sắp xếp thứ tự bằng
auth.order.openai; OPENAI_API_KEY vẫn là phương án dự phòng trực tiếp cho
các bề mặt API OpenAI không thuộc tác tử. Chạy openclaw doctor --fix để di chuyển các
mục thứ tự xác thực Codex cũ.Ví dụ cấu hình
gpt-5.6 của API trực tiếp dạng rút gọn được phân giải thành tầng Sol. Nếu tổ chức API này
không cung cấp GPT-5.6, hãy đặt mô hình chính thành
openai/gpt-5.5 một cách tường minh.Để thử mô hình Instant hiện tại của ChatGPT từ OpenAI API, hãy đặt mô hình
thành openai/chat-latest:chat-latest là bí danh thay đổi theo thời gian. Thay vào đó, thiết lập mới bằng khóa API OpenAI dùng
openai/gpt-5.6, có ID API trực tiếp dạng rút gọn được phân giải thành Sol. Các mô hình chính
tường minh hiện có, bao gồm openai/gpt-5.5, vẫn không thay đổi. Bí danh
chat-latest chỉ chấp nhận độ chi tiết văn bản medium; với mô hình này, OpenClaw buộc
mọi độ chi tiết được yêu cầu khác thành medium.Xác thực app-server Codex gốc
Bộ khung app-server Codex gốc sử dụng các tham chiếu mô hìnhopenai/* khi một tuyến HTTPS
chính thức chính xác và đủ điều kiện chọn ngầm định bộ khung này, hoặc khi
agentRuntime.id: "codex" của nhà cung cấp/mô hình chọn rõ ràng bộ khung này. Cơ chế xác thực vẫn
dựa trên tài khoản. OpenClaw chọn phương thức xác thực theo thứ tự sau:
- Các hồ sơ xác thực OpenAI đã sắp thứ tự cho tác tử, ưu tiên đặt trong
auth.order.openai. Chạyopenclaw doctor --fixđể di chuyển các ID hồ sơ xác thực Codex kế thừa cũ và thứ tự xác thực. - Tài khoản hiện có của app-server, chẳng hạn như phiên đăng nhập ChatGPT của Codex CLI cục bộ. Đối với thư mục chính tác tử cô lập mặc định, OpenClaw kết nối tài khoản CLI gốc đó vào app-server thông qua RPC đăng nhập; OpenClaw không chia sẻ cấu hình, plugin hoặc kho luồng của CLI.
- Chỉ dành cho các lần khởi chạy app-server stdio cục bộ và chỉ khi app-server
báo cáo không có tài khoản:
CODEX_API_KEY, sau đó làOPENAI_API_KEY.
OPENAI_API_KEY cho các mô hình OpenAI trực tiếp hoặc
phép nhúng. Phương án dự phòng dùng khóa API từ môi trường chỉ áp dụng cho đường dẫn stdio cục bộ
không có tài khoản; khóa này không bao giờ được gửi qua các kết nối app-server WebSocket. Khi
một hồ sơ Codex kiểu gói đăng ký được chọn, OpenClaw cũng loại
CODEX_API_KEY và OPENAI_API_KEY khỏi tiến trình con app-server stdio được khởi tạo
và thay vào đó gửi thông tin xác thực đã chọn qua RPC đăng nhập của app-server.
Khi hồ sơ gói đăng ký đó bị chặn do giới hạn sử dụng Codex, OpenClaw
đánh dấu hồ sơ là bị chặn cho đến thời điểm đặt lại do Codex công bố và cho phép thứ tự
xác thực chuyển sang hồ sơ openai:* tiếp theo mà không thay đổi mô hình đã chọn
hoặc rời khỏi bộ khung Codex. Sau khi thời điểm đặt lại trôi qua,
hồ sơ gói đăng ký sẽ lại đủ điều kiện.
Tạo hình ảnh
Pluginopenai đi kèm đăng ký khả năng tạo hình ảnh thông qua
công cụ image_generate. Plugin này hỗ trợ cả việc tạo hình ảnh bằng khóa API OpenAI và OAuth Codex
thông qua cùng một tham chiếu mô hình openai/gpt-image-2.
Xem Tạo hình ảnh để biết các tham số công cụ dùng chung,
cách chọn nhà cung cấp và hành vi chuyển đổi dự phòng.
gpt-image-2 là lựa chọn mặc định để tạo hình ảnh từ văn bản và chỉnh sửa hình ảnh
bằng OpenAI. gpt-image-1.5, gpt-image-1 và gpt-image-1-mini vẫn có thể dùng
làm các ghi đè mô hình rõ ràng. Sử dụng openai/gpt-image-1.5 để tạo đầu ra PNG/WebP
có nền trong suốt; API gpt-image-2 hiện tại từ chối
background: "transparent".
Đối với yêu cầu nền trong suốt, hãy gọi image_generate với
model: "openai/gpt-image-1.5", outputFormat: "png" hoặc "webp", và
background: "transparent"; tùy chọn nhà cung cấp openai.background cũ
vẫn được chấp nhận. OpenClaw cũng bảo vệ các tuyến OpenAI công khai và OAuth OpenAI Codex
bằng cách ghi lại các yêu cầu trong suốt openai/gpt-image-2 mặc định thành
gpt-image-1.5; Azure và các điểm cuối tùy chỉnh tương thích với OpenAI giữ nguyên
tên triển khai/mô hình đã cấu hình.
Thiết lập tương tự cũng được cung cấp cho các lần chạy CLI không giao diện:
--output-format và --background với
openclaw infer image edit khi bắt đầu từ một tệp đầu vào.
--openai-background vẫn có sẵn dưới dạng bí danh dành riêng cho OpenAI. Sử dụng
--quality low|medium|high|auto để kiểm soát chất lượng và chi phí của OpenAI Images.
Sử dụng --openai-moderation low|auto để truyền gợi ý kiểm duyệt của OpenAI từ
image generate hoặc image edit.
Đối với các bản cài đặt dùng OAuth ChatGPT/Codex, hãy giữ nguyên tham chiếu openai/gpt-image-2. Khi
một hồ sơ OAuth openai được cấu hình, OpenClaw phân giải token truy cập OAuth
đã lưu trữ đó và gửi yêu cầu hình ảnh qua phần phụ trợ Codex Responses; OpenClaw
không thử OPENAI_API_KEY trước hoặc âm thầm chuyển sang khóa API.
Hãy cấu hình rõ ràng models.providers.openai bằng khóa API, URL cơ sở tùy chỉnh
hoặc điểm cuối Azure khi bạn muốn sử dụng tuyến API OpenAI Images trực tiếp.
Nếu điểm cuối hình ảnh tùy chỉnh đó nằm trên mạng LAN/địa chỉ riêng đáng tin cậy,
hãy đặt thêm browser.ssrfPolicy.dangerouslyAllowPrivateNetwork: true; OpenClaw
vẫn chặn các điểm cuối hình ảnh tương thích với OpenAI riêng tư/nội bộ trừ khi có
tùy chọn tham gia này.
Tạo:
Tạo video
Pluginopenai đi kèm đăng ký khả năng tạo video thông qua
công cụ video_generate.
Các yêu cầu chuyển đổi hình ảnh thành video của OpenAI sử dụng
POST /v1/videos với một hình ảnh
input_reference. Các chỉnh sửa video đơn sử dụng POST /v1/videos/edits với video
đã tải lên trong trường video.
Xem Tạo video để biết các tham số công cụ dùng chung,
cách chọn nhà cung cấp và hành vi chuyển đổi dự phòng.Nhà cung cấp OpenAI khai báo
supportsSize nhưng không khai báo supportsAspectRatio hoặc
supportsResolution. Lớp chuẩn hóa dùng chung của OpenClaw chuyển đổi
aspectRatio được yêu cầu thành size OpenAI khớp gần nhất trước khi
yêu cầu đến nhà cung cấp, vì vậy các yêu cầu về tỷ lệ khung hình nhìn chung vẫn hoạt động.
resolution không có phương án dự phòng về kích thước và bị loại bỏ, đồng thời được báo cho bên gọi dưới dạng
Ignored unsupported overrides for openai/<model>: resolution=<value>.Phần bổ sung cho prompt GPT-5
OpenClaw thêm một phần bổ sung dùng chung cho prompt GPT-5 đối với các mô hình thuộc họ GPT-5 trên nhà cung cấpopenai (bao gồm các tham chiếu Codex cũ trước khi sửa chữa được chuẩn hóa
thành openai/*). Các nhà cung cấp khác cũng phục vụ id mô hình thuộc họ GPT-5, chẳng hạn
như các tuyến OpenRouter hoặc opencode, không nhận lớp phủ này; lớp phủ được kiểm soát theo
id nhà cung cấp openai, không chỉ theo id mô hình. Các mô hình GPT-4.x cũ không bao giờ
nhận lớp phủ này.
Bộ kiểm thử app-server Codex gốc không nhận hợp đồng hành vi về persona/kỷ luật
sử dụng công cụ hoặc lớp phủ phong cách tương tác thân thiện thông qua
chỉ dẫn dành cho nhà phát triển; Codex gốc giữ nguyên hành vi cơ sở, mô hình và
tài liệu dự án do Codex sở hữu, còn OpenClaw vô hiệu hóa tính cách tích hợp sẵn của Codex cho
các luồng gốc để các tệp tính cách trong không gian làm việc của agent tiếp tục có thẩm quyền.
OpenClaw chỉ bổ sung ngữ cảnh thời gian chạy vào các luồng Codex gốc: phân phối qua
kênh, công cụ động của OpenClaw, ủy quyền ACP, ngữ cảnh không gian làm việc và
Skills của OpenClaw. Văn bản hướng dẫn Heartbeat từ cùng phần bổ sung này là
ngoại lệ duy nhất: các lượt Heartbeat của Codex gốc vẫn nhận văn bản này, được chèn dưới dạng
chỉ dẫn cộng tác chuyên biệt thay vì thông qua hook bổ sung prompt
dùng chung.
Phần bổ sung GPT-5 thêm một hợp đồng hành vi có gắn thẻ cho việc duy trì persona,
an toàn thực thi, kỷ luật sử dụng công cụ, hình thức đầu ra, kiểm tra
hoàn thành và xác minh trên các prompt tương ứng do OpenClaw tập hợp. Hành vi trả lời
theo từng kênh và tin nhắn im lặng vẫn nằm trong prompt hệ thống dùng chung của OpenClaw
và chính sách phân phối đi. Lớp phong cách tương tác thân thiện
tách biệt và có thể cấu hình.
- Cấu hình
- CLI
plugins.entries.openai.config.personality cũ vẫn được đọc làm phương án dự phòng
tương thích khi thiết lập dùng chung
agents.defaults.promptOverlays.gpt5.personality chưa được đặt.Giọng nói và lời nói
Tổng hợp giọng nói (TTS)
Tổng hợp giọng nói (TTS)
Plugin
openai đi kèm đăng ký tính năng tổng hợp giọng nói cho
bề mặt messages.tts.Các mô hình khả dụng:
gpt-4o-mini-tts, tts-1, tts-1-hd. Các giọng nói khả dụng:
alloy, ash, ballad, cedar, coral, echo, fable, juniper,
marin, onyx, nova, sage, shimmer, verse.extraBody được hợp nhất vào JSON yêu cầu /audio/speech sau các trường
do OpenClaw tạo, vì vậy hãy dùng nó cho các điểm cuối tương thích với OpenAI yêu cầu
các khóa bổ sung như lang. Các khóa prototype bị bỏ qua.Đặt
OPENAI_TTS_BASE_URL để ghi đè URL cơ sở của TTS mà không ảnh hưởng đến
điểm cuối API trò chuyện. TTS và giọng nói Realtime của OpenAI đều được cấu hình
thông qua khóa API OpenAI Platform; các bản cài đặt chỉ dùng OAuth vẫn có thể sử dụng
các mô hình trò chuyện dựa trên Codex, nhưng không thể dùng tính năng trò chuyện thoại trực tiếp của OpenAI.Chuyển giọng nói thành văn bản
Chuyển giọng nói thành văn bản
Plugin Các gợi ý về ngôn ngữ và prompt được chuyển tiếp đến OpenAI khi được cung cấp bởi
cấu hình đa phương tiện âm thanh dùng chung hoặc yêu cầu phiên âm riêng cho từng lệnh gọi.
openai đi kèm đăng ký tính năng chuyển giọng nói thành văn bản theo lô thông qua
bề mặt phiên âm hiểu nội dung đa phương tiện của OpenClaw.- Mô hình mặc định:
gpt-4o-transcribe - Điểm cuối: OpenAI REST
/v1/audio/transcriptions - Đường dẫn đầu vào: tải lên tệp âm thanh multipart
- Được dùng ở mọi nơi tính năng phiên âm âm thanh đầu vào đọc
tools.media.audio, bao gồm các phân đoạn kênh thoại Discord và tệp đính kèm âm thanh của kênh
Phiên âm theo thời gian thực
Phiên âm theo thời gian thực
Plugin
openai đi kèm đăng ký tính năng phiên âm theo thời gian thực cho
Plugin Cuộc gọi thoại.Sử dụng kết nối WebSocket đến
wss://api.openai.com/v1/realtime với âm thanh
G.711 u-law (g711_ulaw / audio/pcmu). Đối với hồ sơ khóa API openai,
Gateway tạo một bí mật ứng dụng khách phiên âm Realtime tạm thời
trước khi mở WebSocket. Nhà cung cấp truyền trực tuyến này dành cho đường dẫn
phiên âm theo thời gian thực của Cuộc gọi thoại; tính năng thoại Discord hiện ghi lại các
phân đoạn ngắn và thay vào đó sử dụng đường dẫn phiên âm theo lô tools.media.audio.Giọng nói theo thời gian thực
Giọng nói theo thời gian thực
Plugin
openai đi kèm đăng ký tính năng giọng nói theo thời gian thực cho Plugin
Cuộc gọi thoại.Các giọng nói Realtime tích hợp sẵn khả dụng cho
gpt-realtime-2.1: alloy, ash,
ballad, coral, echo, sage, shimmer, verse, marin, cedar.
OpenAI khuyến nghị marin và cedar để có chất lượng Realtime tốt nhất. Đây
là một tập hợp riêng biệt với các giọng nói chuyển văn bản thành giọng nói ở trên; một giọng nói chỉ dành cho TTS
như fable, nova hoặc onyx không hợp lệ cho các phiên Realtime.
Đặt rõ mô hình thành gpt-realtime-2.1-mini khi ưu tiên
biến thể Realtime 2.1 nhỏ hơn, chi phí thấp hơn.GPT-Live (sắp ra mắt). Các mô hình song công hoàn toàn
gpt-live-1 và
gpt-live-1-mini của OpenAI đã thay thế chế độ thoại ChatGPT vào tháng 7 năm 2026; API dành cho
nhà phát triển đang được triển khai cho các tổ chức có quyền truy cập sớm. OpenClaw
nhận diện họ mô hình này nhưng chưa chạy được: các phiên GPT-Live
chỉ dùng WebRTC, tự quản lý việc luân phiên lượt nói (không có VAD) và ủy quyền công việc của agent
thông qua một giao thức sự kiện bàn giao mà các phương thức truyền tải theo thời gian thực của OpenClaw
chưa triển khai. Việc cấu hình một mô hình gpt-live-* sẽ thất bại theo cơ chế đóng
kèm hướng dẫn cho cả cầu nối WebSocket và các phiên trình duyệt Talk thay vì
âm thầm kết nối âm thanh mà không có quyền truy cập agent. Quyền truy cập API cũng được giới hạn
theo từng tổ chức OpenAI trong giai đoạn truy cập sớm. Hãy giữ gpt-realtime-2.1 (giá trị
mặc định) cho đến khi OpenClaw hỗ trợ GPT-Live.Các cầu nối realtime OpenAI ở backend sử dụng cấu trúc phiên WebSocket Realtime
GA, vốn không chấp nhận
session.temperature. Các bản triển khai Azure OpenAI
vẫn khả dụng thông qua azureEndpoint và azureDeployment, đồng thời
giữ cấu trúc phiên tương thích với bản triển khai (bao gồm temperature).
Hỗ trợ gọi công cụ hai chiều và âm thanh G.711 u-law.Giọng nói thời gian thực được chọn khi phiên được tạo. OpenAI cho phép thay đổi hầu hết
các trường của phiên sau đó, nhưng không thể thay đổi giọng nói sau khi
mô hình đã phát âm thanh trong phiên đó. OpenClaw hiện cung cấp các
id giọng nói Realtime tích hợp sẵn dưới dạng chuỗi.
Talk trong Control UI sử dụng các phiên thời gian thực trên trình duyệt của OpenAI với bí mật máy khách tạm thời
do Gateway cấp và trao đổi SDP WebRTC trực tiếp từ trình duyệt
với OpenAI Realtime API. Gateway cấp bí mật máy khách đó bằng
thông tin xác thực
openai đã chọn. Các khóa đã cấu hình, hồ sơ khóa API và
OPENAI_API_KEY được ưu tiên; hồ sơ OAuth openai hoặc thông tin đăng nhập
Codex bên ngoài được dùng làm phương án dự phòng. Các cầu nối WebSocket thời gian thực của Gateway relay và phần phụ trợ Voice Call
sử dụng cùng thứ tự thông tin xác thực cho các điểm cuối OpenAI gốc.
Quy trình xác minh trực tiếp dành cho người bảo trì có sẵn qua
OPENAI_API_KEY=... GEMINI_API_KEY=... node --import tsx scripts/dev/realtime-talk-live-smoke.ts;
các chặng OpenAI xác minh cả cầu nối WebSocket phần phụ trợ lẫn trao đổi
SDP WebRTC của trình duyệt mà không ghi nhật ký bí mật.
Truyền --openai-only để chạy hai chặng đó mà không cần thông tin xác thực Google.Các điểm cuối Azure OpenAI
Nhà cung cấpopenai đi kèm có thể nhắm đến tài nguyên Azure OpenAI để tạo
hình ảnh bằng cách ghi đè URL cơ sở. Trên đường dẫn tạo hình ảnh, OpenClaw
phát hiện tên máy chủ Azure trong models.providers.openai.baseUrl và tự động chuyển sang
cấu trúc yêu cầu của Azure.
Giọng nói thời gian thực sử dụng một đường dẫn cấu hình riêng
(
plugins.entries.voice-call.config.realtime.providers.openai.azureEndpoint)
và không bị ảnh hưởng bởi models.providers.openai.baseUrl. Xem mục thu gọn Giọng nói
thời gian thực trong Giọng nói và lời nói để biết các cài đặt Azure
của tính năng này.- Bạn đã có gói đăng ký, hạn ngạch hoặc thỏa thuận doanh nghiệp Azure OpenAI
- Bạn cần khả năng lưu trú dữ liệu theo khu vực hoặc các biện pháp kiểm soát tuân thủ do Azure cung cấp
- Bạn muốn giữ lưu lượng bên trong một đối tượng thuê Azure hiện có
Cấu hình
Để tạo hình ảnh Azure thông qua nhà cung cấpopenai đi kèm, hãy trỏ
models.providers.openai.baseUrl đến tài nguyên Azure của bạn và đặt apiKey thành
khóa Azure OpenAI (không phải khóa OpenAI Platform):
*.openai.azure.com*.services.ai.azure.com*.cognitiveservices.azure.com
- Gửi tiêu đề
api-keythay choAuthorization: Bearer - Sử dụng các đường dẫn theo phạm vi triển khai (
/openai/deployments/{deployment}/...) - Nối thêm
?api-version=...vào mỗi yêu cầu - Sử dụng thời gian chờ yêu cầu mặc định là 600s cho các lệnh gọi tạo hình ảnh Azure.
Các giá trị
timeoutMstheo từng lệnh gọi vẫn ghi đè giá trị mặc định này.
Việc định tuyến Azure cho đường dẫn tạo hình ảnh của nhà cung cấp
openai yêu cầu
OpenClaw 2026.4.22 trở lên. Các phiên bản cũ hơn xem mọi
openai.baseUrl tùy chỉnh như điểm cuối OpenAI công khai và không hoạt động với các triển khai hình ảnh
Azure.Phiên bản API
ĐặtAZURE_OPENAI_API_VERSION để cố định một phiên bản Azure preview hoặc GA cụ thể
cho đường dẫn tạo hình ảnh Azure:
2024-12-01-preview khi biến chưa được đặt.
Tên mô hình là tên triển khai
Azure OpenAI liên kết mô hình với các triển khai. Đối với các yêu cầu tạo hình ảnh Azure được định tuyến qua nhà cung cấpopenai đi kèm, trường model trong OpenClaw
phải là tên triển khai Azure mà bạn đã cấu hình trong cổng thông tin Azure, không phải
id mô hình OpenAI công khai.
Nếu bạn tạo một triển khai có tên gpt-image-2-prod phục vụ gpt-image-2:
openai đi kèm.
Phạm vi cung cấp theo khu vực
Tính năng tạo hình ảnh Azure hiện chỉ có ở một số khu vực (ví dụ:eastus2, swedencentral, polandcentral, westus3,
uaenorth). Hãy kiểm tra danh sách khu vực hiện tại của Microsoft trước khi tạo
triển khai và xác nhận mô hình cụ thể được cung cấp trong khu vực của bạn.
Khác biệt về tham số
Azure OpenAI và OpenAI công khai không phải lúc nào cũng chấp nhận cùng các tham số hình ảnh. Azure có thể từ chối các tùy chọn mà OpenAI công khai cho phép (ví dụ một số giá trịbackground trên gpt-image-2) hoặc chỉ cung cấp chúng trên các phiên bản mô hình
cụ thể. Những khác biệt này bắt nguồn từ Azure và mô hình nền tảng, không phải
OpenClaw. Nếu một yêu cầu Azure thất bại với lỗi xác thực, hãy kiểm tra
tập hợp tham số được phiên bản triển khai và API cụ thể của bạn hỗ trợ trong
cổng thông tin Azure.
Azure OpenAI sử dụng cơ chế truyền tải gốc và hành vi tương thích nhưng không nhận
các tiêu đề ghi công ẩn của OpenClaw — xem mục thu gọn Tuyến gốc và tuyến tương thích
OpenAI trong Cấu hình nâng cao.Đối với lưu lượng trò chuyện hoặc Responses trên Azure (ngoài tạo hình ảnh), hãy sử dụng
luồng thiết lập ban đầu hoặc cấu hình nhà cung cấp Azure chuyên biệt; chỉ riêng
openai.baseUrl
không áp dụng cấu trúc API/xác thực Azure. Có một nhà cung cấp
azure-openai-responses/* riêng; xem mục thu gọn Compaction phía máy chủ
bên dưới.Cấu hình nâng cao
Các ví dụparams theo từng mô hình bên dưới định hình yêu cầu nhà cung cấp nhúng
của OpenClaw. Việc cấu hình chúng là hành vi yêu cầu do người dùng chỉ định, vì vậy một tuyến
auto vốn đủ điều kiện vẫn chạy trên OpenClaw thay vì ngầm chọn Codex. Bộ khung
app-server Codex gốc sở hữu cơ chế truyền tải và cài đặt yêu cầu riêng; agentRuntime.id: "codex"
tường minh sẽ đóng khi lỗi nếu tuyến hiệu lực không được khai báo là
tương thích Codex.
Cơ chế truyền tải (WebSocket và SSE)
Cơ chế truyền tải (WebSocket và SSE)
OpenClaw ưu tiên WebSocket với SSE làm phương án dự phòng (Tài liệu OpenAI liên quan:
"auto") cho openai/*.Trong chế độ "auto", OpenClaw:- Thử lại một lần khi WebSocket gặp lỗi sớm trước khi chuyển sang SSE
- Sau khi gặp lỗi, đánh dấu WebSocket là suy giảm trong 60 giây và sử dụng SSE trong thời gian chờ khôi phục
- Đính kèm các tiêu đề định danh phiên và lượt ổn định cho các lần thử lại và kết nối lại
- Chuẩn hóa các bộ đếm mức sử dụng (
input_tokens/prompt_tokens) giữa các biến thể cơ chế truyền tải
Chế độ nhanh
Chế độ nhanh
OpenClaw cung cấp một nút chuyển chế độ nhanh dùng chung cho
openai/*:- Trò chuyện/UI:
/fast status|auto|on|off - Cấu hình:
agents.defaults.models["<provider>/<model>"].params.fastMode
service_tier = "priority"). Các giá trị service_tier hiện có được
giữ nguyên và chế độ nhanh không ghi lại reasoning hoặc
text.verbosity. fastMode: "auto" bắt đầu các lệnh gọi mô hình mới ở chế độ nhanh cho đến
ngưỡng tự động, sau đó bắt đầu các lệnh gọi thử lại, dự phòng, kết quả công cụ hoặc
tiếp tục về sau mà không dùng chế độ nhanh. Ngưỡng mặc định là 60 giây;
đặt params.fastAutoOnSeconds trên mô hình đang hoạt động để thay đổi.Ghi đè của phiên được ưu tiên hơn cấu hình. Xóa ghi đè phiên trong
Sessions UI sẽ đưa phiên trở lại giá trị mặc định đã cấu hình.
Xử lý ưu tiên (service_tier)
Xử lý ưu tiên (service_tier)
API của OpenAI cung cấp xử lý ưu tiên qua Các giá trị được hỗ trợ:
service_tier. Đặt giá trị này theo từng
mô hình trong OpenClaw:auto, default, flex, priority.Compaction phía máy chủ (Responses API)
Compaction phía máy chủ (Responses API)
Đối với các mô hình OpenAI Responses trực tiếp (
openai/* trên api.openai.com), trình bao bọc
luồng OpenClaw của Plugin OpenAI tự động bật Compaction phía máy chủ:- Buộc
store: true(trừ khi khả năng tương thích của mô hình đặtsupportsStore: false) - Chèn
context_management: [{ type: "compaction", compact_threshold: ... }] compact_thresholdmặc định: 70% củacontextWindow(hoặc80000khi không khả dụng)
- Bật rõ ràng
- Ngưỡng tùy chỉnh
- Tắt
Hữu ích cho các điểm cuối tương thích như Azure OpenAI Responses:
responsesServerCompaction chỉ kiểm soát việc chèn context_management.
Các mô hình OpenAI Responses trực tiếp vẫn buộc store: true trừ khi khả năng tương thích
đặt supportsStore: false.Chế độ GPT tác tử nghiêm ngặt
Chế độ GPT tác tử nghiêm ngặt
Đối với các mô hình thuộc họ GPT-5 của nhà cung cấp Việc đặt
openai chạy qua môi trường chạy nhúng
của OpenClaw, OpenClaw đã mặc định sử dụng một hợp đồng thực thi nghiêm ngặt hơn có tên
strict-agentic. Hợp đồng này tự động kích hoạt bất cứ khi nào nhà cung cấp đã phân giải là
openai và id mô hình khớp với họ GPT-5, trừ khi cấu hình
tường minh chọn không sử dụng:"strict-agentic" một cách tường minh không tạo ra tác động nào trên một tuyến được hỗ trợ (giá trị này
đã là mặc định) và không có hiệu lực đối với các cặp nhà cung cấp/mô hình không được hỗ trợ.Khi strict-agentic đang hoạt động, OpenClaw:- Tự động bật
update_plancho công việc đáng kể - Thử lại các lượt không có nội dung về mặt cấu trúc hoặc chỉ có lập luận bằng một lượt tiếp tục có câu trả lời hiển thị
- Sử dụng các sự kiện kế hoạch tường minh của harness khi harness đã chọn cung cấp chúng
Hợp đồng này hoàn toàn nằm trong trình chạy agent nhúng của OpenClaw. Hợp đồng này
không áp dụng cho harness app-server Codex gốc, vốn tự quản lý
hành vi lượt và kế hoạch; đối với các lần chạy Codex gốc, việc chọn harness quan trọng hơn
cài đặt hợp đồng thực thi.
Tuyến gốc so với tuyến tương thích OpenAI
Tuyến gốc so với tuyến tương thích OpenAI
OpenClaw xử lý các endpoint trực tiếp của OpenAI, Codex và Azure OpenAI
khác với các proxy
/v1 tương thích OpenAI dùng chung:Tuyến gốc (openai/*, Azure OpenAI):- Chỉ giữ
reasoning: { effort: "none" }cho các mô hình hỗ trợ mứcnonecủa OpenAI - Bỏ qua chế độ lập luận bị tắt đối với các mô hình hoặc proxy từ chối
reasoning.effort: "none" - Mặc định dùng chế độ nghiêm ngặt cho các schema công cụ
- Chỉ đính kèm các header ghi nhận nguồn ẩn trên các máy chủ gốc đã xác minh (Azure OpenAI không nhận các header này, dù đây là một tuyến gốc)
- Giữ định dạng yêu cầu chỉ dành cho OpenAI (
service_tier,store, tương thích lập luận, gợi ý bộ nhớ đệm prompt)
- Sử dụng hành vi tương thích ít nghiêm ngặt hơn
- Loại bỏ
storecủa Completions khỏi các payloadopenai-completionskhông phải gốc - Chấp nhận JSON chuyển tiếp
params.extra_body/params.extraBodynâng cao cho các proxy Completions tương thích OpenAI - Chấp nhận
params.chat_template_kwargscho các proxy Completions tương thích OpenAI như vLLM - Không bắt buộc dùng schema công cụ nghiêm ngặt hoặc các header chỉ dành cho tuyến gốc
Liên quan
Lựa chọn mô hình
Chọn nhà cung cấp, tham chiếu mô hình và hành vi chuyển đổi dự phòng.
Tạo hình ảnh
Các tham số công cụ hình ảnh dùng chung và việc lựa chọn nhà cung cấp.
Tạo video
Các tham số công cụ video dùng chung và việc lựa chọn nhà cung cấp.
OAuth và xác thực
Chi tiết xác thực và quy tắc tái sử dụng thông tin xác thực.