Chức năng
- Chỉ thị nội tuyến trong nội dung của bất kỳ tin nhắn đến nào:
/t <level>,/think:<level>hoặc/thinking <level>. - Các mức (bí danh):
off | minimal | low | medium | high | xhigh | adaptive | max | ultra, gần tương ứng với thang từ khóa đặc biệt kinh điển của Anthropic: “think” < “think hard” < “think harder” < “ultrathink”:- minimal ~ “think”
- low ~ “think hard”
- medium ~ “think harder”
- high ~ “ultrathink” (ngân sách tối đa)
- xhigh ~ “ultrathink+” (các mô hình GPT-5.2+ và Codex, cùng mức nỗ lực của Anthropic Claude Opus 4.7+)
- adaptive → tư duy thích ứng do nhà cung cấp quản lý (được hỗ trợ cho Claude 4.6 trên Anthropic/Bedrock, Anthropic Claude Opus 4.7+ và tư duy động của Google Gemini)
- max → suy luận tối đa của nhà cung cấp (Anthropic Claude Opus 4.7+; Ollama ánh xạ mức này sang nỗ lực
thinkgốc cao nhất) - ultra → suy luận tối đa của nhà cung cấp cộng với điều phối chủ động các tác nhân phụ khi mô hình/môi trường chạy đã chọn hỗ trợ
x-high,x_high,extra-high,extra highvàextra_highánh xạ sangxhigh.highestánh xạ sanghigh.
- Lưu ý về nhà cung cấp:
- Các trình đơn và bộ chọn tư duy được điều khiển bởi hồ sơ nhà cung cấp. Plugin của nhà cung cấp khai báo chính xác tập hợp mức cho mô hình đã chọn, bao gồm các nhãn như
onnhị phân. adaptive,xhigh,maxvàultrachỉ được công bố cho các hồ sơ nhà cung cấp/mô hình/môi trường chạy hỗ trợ chúng. Các chỉ thị có kiểu cho mức không được hỗ trợ sẽ bị từ chối kèm theo những tùy chọn hợp lệ của mô hình đó.- Các mức không được hỗ trợ đã lưu trước đó được ánh xạ lại theo thứ hạng hồ sơ nhà cung cấp.
adaptivechuyển vềmediumtrên các mô hình không thích ứng, cònxhighvàmaxchuyển về mức khác tắt lớn nhất được hỗ trợ cho mô hình đã chọn. - Các mô hình Anthropic Claude 4.6 mặc định dùng
adaptivekhi không đặt mức tư duy rõ ràng. - Anthropic Claude Opus 4.8 và Opus 4.7 giữ tư duy ở trạng thái tắt trừ khi bạn đặt rõ ràng một mức tư duy. Mức nỗ lực mặc định do nhà cung cấp sở hữu của Opus 4.8 là
highsau khi bật tư duy thích ứng. - Anthropic Claude Opus 4.7+ ánh xạ
/think xhighsang tư duy thích ứng cộng vớioutput_config.effort: "xhigh", vì/thinklà chỉ thị tư duy cònxhighlà thiết lập nỗ lực của Opus. - Anthropic Claude Opus 4.7+ cũng cung cấp
/think max; mức này ánh xạ sang cùng đường dẫn nỗ lực tối đa do nhà cung cấp sở hữu. - Các mô hình DeepSeek V4 trực tiếp cung cấp
/think xhigh|max; cả hai đều ánh xạ sangreasoning_effort: "max"của DeepSeek, còn các mức thấp hơn nhưng không tắt ánh xạ sanghigh. - Các mô hình DeepSeek V4 được định tuyến qua OpenRouter cung cấp
/think xhighvà gửi các giá trịreasoning.effortđược OpenRouter hỗ trợ thay vìreasoning_effortcấp cao nhất gốc của DeepSeek. Các mức thấp hơn nhưng không tắt ánh xạ sanghigh, còn các giá trị ghi đèmaxđã lưu chuyển vềxhigh. - Các mô hình Ollama có khả năng tư duy cung cấp
/think low|medium|high|max;maxánh xạ sangthink: "high"gốc vì API gốc của Ollama chấp nhận các chuỗi nỗ lựclow,mediumvàhigh. - Các mô hình OpenAI GPT ánh xạ
/thinkthông qua khả năng hỗ trợ nỗ lực riêng theo mô hình của Responses API./think offchỉ gửireasoning.effort: "none"khi mô hình đích hỗ trợ; nếu không, OpenClaw bỏ qua tải suy luận đã tắt thay vì gửi một giá trị không được hỗ trợ. - GPT-5.6 Sol và Terra cung cấp
/think ultragốc thông qua môi trường chạy Codex. GPT-5.6 Luna cung cấp các mức đếnmaxvì danh mục Codex của nó không công bố Ultra. - Môi trường chạy OpenClaw nhúng cung cấp
/think ultralogic cho GPT-5.6 Sol, Terra và Luna. Môi trường này gửi nỗ lực tối đa của nhà cung cấp và thêm hướng dẫn điều phối chủ động các tác nhân phụ trong phạm vi lượt chạy. - Các mục danh mục tùy chỉnh tương thích với OpenAI có thể chọn dùng
/think xhighbằng cách đặtmodels.providers.<provider>.models[].compat.supportedReasoningEffortsđể bao gồm"xhigh". Cơ chế này sử dụng cùng siêu dữ liệu tương thích để ánh xạ tải nỗ lực suy luận OpenAI gửi đi, nhờ đó các trình đơn, xác thực phiên, CLI của tác nhân vàllm-tasknhất quán với hành vi truyền tải. - Các tham chiếu OpenRouter Hunter Alpha đã ngừng hoạt động nhưng vẫn còn trong cấu hình sẽ bỏ qua việc chèn suy luận proxy vì tuyến đã ngừng này có thể trả về văn bản câu trả lời cuối cùng qua các trường suy luận.
- Google Gemini ánh xạ
/think adaptivesang tư duy động do nhà cung cấp sở hữu của Gemini. Các yêu cầu Gemini 3 bỏ quathinkingLevelcố định, còn các yêu cầu Gemini 2.5 gửithinkingBudget: -1; các mức cố định vẫn ánh xạ sangthinkingLevelhoặc ngân sách Gemini gần nhất cho dòng mô hình đó. - MiniMax M2.x (
minimax/MiniMax-M2*) trên đường dẫn truyền phát tương thích với Anthropic mặc định dùngthinking: { type: "disabled" }trừ khi bạn đặt rõ ràng tư duy trong tham số mô hình hoặc tham số yêu cầu. Điều này tránh để lộ các deltareasoning_contenttừ định dạng luồng Anthropic không gốc của M2.x. MiniMax-M3 (và M3.x) được miễn: M3 phát ra các khối tư duy Anthropic đúng chuẩn và trả về nội dung trống khi tư duy bị tắt, vì vậy OpenClaw giữ M3 trên đường dẫn tư duy bị bỏ qua/thích ứng của nhà cung cấp. - Z.AI (
zai/*) là dạng nhị phân (on/off) đối với hầu hết các mô hình GLM. GLM-5.2 là ngoại lệ: mô hình này cung cấp/think off|low|high|max, ánh xạlowvàhighsangreasoning_effort: "high"của Z.AI, đồng thời ánh xạmaxsangreasoning_effort: "max". - Kimi K3 của Moonshot API (
moonshot/kimi-k3) luôn tư duy ở mứcmax, gửireasoning_effort: "max", bỏ qua trườngthinkingcủa K2 và các giá trị ghi đè lấy mẫu cố định, đồng thời giữ nguyên các lựa chọn công cụ được K3 hỗ trợ. Kimi Code K3 (kimi/k3vàkimi/k3[1m]) cung cấp/think off|max: trạng thái tắt gửithinking.type: "disabled", còn mức tối đa gửi tư duy thích ứng với nỗ lực tối đa. Các tham chiếu Kimi Code hiện tại cũng bao gồmkimi/kimi-for-codingvàkimi/kimi-for-coding-highspeed. Kimi K2.7 Code (moonshot/kimi-k2.7-codevàmoonshot/kimi-k2.7-code-highspeed) luôn tư duy, chỉ cung cấpon, đồng thời bỏ qua cảthinkingvàreasoning_effortgửi đi. Các mô hìnhmoonshot/*khác ánh xạ/think offsangthinking: { type: "disabled" }và mọi mức không phảioffsangthinking: { type: "enabled" }. Khi bật tư duy K2, Moonshot chỉ chấp nhậntool_choiceauto|none; OpenClaw chuẩn hóa các giá trị không tương thích thànhauto.
- Các trình đơn và bộ chọn tư duy được điều khiển bởi hồ sơ nhà cung cấp. Plugin của nhà cung cấp khai báo chính xác tập hợp mức cho mô hình đã chọn, bao gồm các nhãn như
Thứ tự phân giải
- Chỉ thị nội tuyến trên tin nhắn (chỉ áp dụng cho tin nhắn đó).
- Giá trị ghi đè của phiên (được đặt bằng cách gửi một tin nhắn chỉ chứa chỉ thị).
- Giá trị mặc định theo tác nhân (
agents.list[].thinkingDefaulttrong cấu hình). - Giá trị mặc định toàn cục (
agents.defaults.thinkingDefaulttrong cấu hình). - Dự phòng: giá trị mặc định do nhà cung cấp khai báo nếu có; nếu không, các mô hình có khả năng suy luận phân giải thành
mediumhoặc mức không phảioffgần nhất được hỗ trợ cho mô hình đó, còn các mô hình không suy luận vẫn ởoff.
Đặt giá trị mặc định cho phiên
- Gửi một tin nhắn chỉ chứa chỉ thị (cho phép khoảng trắng), ví dụ:
/think:mediumhoặc/t high. - Thiết lập đó được duy trì trong phiên hiện tại (mặc định theo từng người gửi). Dùng
/think defaultđể xóa giá trị ghi đè của phiên và kế thừa giá trị mặc định của cấu hình/nhà cung cấp; các bí danh bao gồminherit,clear,resetvàunpin. /think offlưu một giá trị ghi đè tắt rõ ràng. Thiết lập này vô hiệu hóa tư duy cho đến khi bạn thay đổi hoặc xóa giá trị ghi đè của phiên.- Một phản hồi xác nhận sẽ được gửi (
Thinking level set to high./Thinking disabled.). Nếu mức không hợp lệ (ví dụ:/thinking big), lệnh sẽ bị từ chối kèm gợi ý và trạng thái phiên không thay đổi. - Gửi
/think(hoặc/think:) mà không có đối số để xem mức tư duy hiện tại.
Áp dụng theo tác nhân
- OpenClaw nhúng: mức đã phân giải được truyền tới môi trường chạy tác nhân OpenClaw trong tiến trình.
- Phần phụ trợ Claude CLI: các mức cụ thể không phải tắt được truyền tới Claude Code dưới dạng
--effortkhi dùngclaude-cli;adaptiveloại bỏ các cờ nỗ lực đã cấu hình và giao mức nỗ lực thực tế cho môi trường, thiết lập và giá trị mặc định của mô hình trong Claude Code. Xem các phần phụ trợ CLI.
Chế độ nhanh (/fast)
- Các mức:
auto|on|off|default. - Tin nhắn chỉ chứa chỉ thị sẽ chuyển đổi giá trị ghi đè chế độ nhanh của phiên và phản hồi
Fast mode set to auto.,Fast mode enabled.hoặcFast mode disabled.. Dùng/fast defaultđể xóa giá trị ghi đè của phiên và kế thừa giá trị mặc định đã cấu hình; các bí danh bao gồminherit,clear,resetvàunpin. - Gửi
/fast(hoặc/fast status) mà không có chế độ để xem trạng thái chế độ nhanh hiệu lực hiện tại. - OpenClaw phân giải chế độ nhanh theo thứ tự sau:
- Giá trị ghi đè
/fast auto|on|offnội tuyến/chỉ chứa chỉ thị (/fast defaultxóa lớp này) - Giá trị ghi đè của phiên
- Giá trị mặc định theo tác nhân (
agents.list[].fastModeDefault) - Cấu hình theo mô hình:
agents.defaults.models["<provider>/<model>"].params.fastMode - Dự phòng:
off
- Giá trị ghi đè
autogiữ chế độ phiên/cấu hình ở trạng thái tự động nhưng phân giải độc lập từng lệnh gọi mô hình mới. Các lệnh gọi bắt đầu trước thời điểm giới hạn tự động sẽ bật chế độ nhanh; các lệnh gọi thử lại, dự phòng, kết quả công cụ hoặc tiếp tục về sau sẽ bắt đầu với chế độ nhanh bị tắt. Thời điểm giới hạn mặc định là 60 giây; đặtagents.defaults.models["<provider>/<model>"].params.fastAutoOnSecondstrên mô hình đang hoạt động để thay đổi.- Đối với
openai/*, chế độ nhanh ánh xạ sang xử lý ưu tiên của OpenAI bằng cách gửiservice_tier=prioritytrong các yêu cầu Responses được hỗ trợ. - Đối với các mô hình
openai/*/openai-codex/*dựa trên Codex, chế độ nhanh gửi cùng cờservice_tier=prioritytrong Codex Responses. Các lượt app-server Codex gốc chỉ nhận cấp dịch vụ tạiturn/starthoặc khi bắt đầu/tiếp tục luồng, vì vậyautokhông thể thay đổi cấp dịch vụ của một lượt app-server đang chạy; thiết lập này áp dụng cho lượt mô hình tiếp theo do OpenClaw khởi chạy. - Đối với các yêu cầu công khai trực tiếp
anthropic/*, bao gồm lưu lượng được xác thực bằng OAuth gửi tớiapi.anthropic.com, chế độ nhanh ánh xạ sang các cấp dịch vụ Anthropic:/fast onđặtservice_tier=auto,/fast offđặtservice_tier=standard_only. - Đối với
minimax/*trên đường dẫn tương thích với Anthropic,/fast on(hoặcparams.fastMode: true) ghi lạiMiniMax-M2.7thànhMiniMax-M2.7-highspeed. - Các tham số mô hình Anthropic
serviceTier/service_tierđược đặt rõ ràng sẽ ghi đè giá trị mặc định của chế độ nhanh khi cả hai cùng được đặt. OpenClaw vẫn bỏ qua việc chèn cấp dịch vụ Anthropic đối với các URL cơ sở proxy không phải Anthropic. /statushiển thịFastkhi chế độ nhanh được bật vàFast:autokhi chế độ đã cấu hình là tự động.
Chỉ thị chi tiết (/verbose hoặc /v)
- Các mức:
on(tối thiểu) |full|off(mặc định). - Tin nhắn chỉ chứa chỉ thị sẽ chuyển đổi chế độ chi tiết của phiên và phản hồi
Verbose logging enabled./Verbose logging disabled.; mức không hợp lệ sẽ trả về gợi ý mà không thay đổi trạng thái. /verbose offlưu một giá trị ghi đè phiên tường minh; xóa giá trị này qua giao diện Sessions bằng cách chọninherit.- Người gửi được ủy quyền trên kênh bên ngoài có thể duy trì giá trị ghi đè chế độ chi tiết của phiên. Các máy khách gateway/webchat nội bộ cần
operator.adminđể duy trì giá trị này. - Chỉ thị nội tuyến chỉ ảnh hưởng đến tin nhắn đó; nếu không, các giá trị mặc định của phiên/toàn cục sẽ được áp dụng.
- Gửi
/verbose(hoặc/verbose:) mà không có đối số để xem mức chi tiết hiện tại. - Khi bật chế độ chi tiết, các tác nhân phát ra kết quả công cụ có cấu trúc sẽ gửi lại từng lệnh gọi công cụ dưới dạng một tin nhắn riêng chỉ chứa siêu dữ liệu, với tiền tố
<emoji> <tool-name>: <arg>khi có. Các bản tóm tắt công cụ này được gửi ngay khi từng công cụ bắt đầu (trong các bong bóng riêng), không phải dưới dạng các phần chênh lệch được truyền trực tiếp. - Bản tóm tắt lỗi công cụ vẫn hiển thị trong chế độ thông thường, nhưng các hậu tố chi tiết lỗi thô sẽ bị ẩn trừ khi chế độ chi tiết là
full. - Khi chế độ chi tiết là
full, đầu ra của công cụ cũng được chuyển tiếp sau khi hoàn tất (trong bong bóng riêng, được cắt ngắn đến độ dài an toàn). Nếu bạn chuyển đổi/verbose on|full|offtrong khi một lượt chạy đang diễn ra, các bong bóng công cụ tiếp theo sẽ tuân theo thiết lập mới. agents.defaults.toolProgressDetailkiểm soát hình thức của các bản tóm tắt công cụ/verbosevà các dòng công cụ trong bản nháp tiến trình. Dùng"explain"(mặc định) cho các nhãn ngắn gọn, dễ hiểu như🛠️ Exec: checking JS syntax; dùng"raw"khi bạn cũng muốn nối thêm lệnh/chi tiết thô để gỡ lỗi.agents.list[].toolProgressDetailtheo từng tác nhân sẽ ghi đè giá trị mặc định.explain:🛠️ Exec: check JS syntax for /tmp/app.jsraw:🛠️ Exec: check JS syntax for /tmp/app.js, node --check /tmp/app.js
Chỉ thị truy vết Plugin (/trace)
- Các mức:
on|off(mặc định). - Tin nhắn chỉ chứa chỉ thị sẽ chuyển đổi đầu ra truy vết Plugin của phiên và phản hồi
Plugin trace enabled./Plugin trace disabled.. - Chỉ thị nội tuyến chỉ ảnh hưởng đến tin nhắn đó; nếu không, các giá trị mặc định của phiên/toàn cục sẽ được áp dụng.
- Gửi
/trace(hoặc/trace:) mà không có đối số để xem mức truy vết hiện tại. /tracecó phạm vi hẹp hơn/verbose: nó chỉ hiển thị các dòng truy vết/gỡ lỗi do Plugin sở hữu, chẳng hạn như bản tóm tắt gỡ lỗi Active Memory.- Các dòng truy vết có thể xuất hiện trong
/statusvà dưới dạng một tin nhắn chẩn đoán tiếp theo sau phản hồi thông thường của trợ lý.
Khả năng hiển thị quá trình suy luận (/reasoning)
- Các mức:
on|off|stream. - Tin nhắn chỉ chứa chỉ thị sẽ chuyển đổi việc các khối suy nghĩ có được hiển thị trong phản hồi hay không.
- Khi được bật, quá trình suy luận được gửi dưới dạng tin nhắn riêng với tiền tố
Thinking. stream: truyền trực tiếp quá trình suy luận trong lúc phản hồi đang được tạo khi kênh đang hoạt động hỗ trợ bản xem trước quá trình suy luận, sau đó gửi câu trả lời cuối cùng không kèm quá trình suy luận.- Bí danh:
/reason. - Gửi
/reasoning(hoặc/reasoning:) mà không có đối số để xem mức suy luận hiện tại. - Thứ tự phân giải: chỉ thị nội tuyến, sau đó là giá trị ghi đè của phiên, rồi giá trị mặc định theo từng tác nhân (
agents.list[].reasoningDefault), tiếp theo là giá trị mặc định toàn cục (agents.defaults.reasoningDefault), rồi giá trị dự phòng (off).
<think>...</think> đã đóng vẫn bị ẩn trong phản hồi thông thường, và phần suy luận chưa đóng xuất hiện sau văn bản đã hiển thị cũng bị ẩn. Nếu một phản hồi được bao bọc hoàn toàn trong một thẻ mở duy nhất chưa đóng và nếu không sẽ được gửi dưới dạng văn bản trống, OpenClaw sẽ xóa thẻ mở sai định dạng và gửi phần văn bản còn lại.
Liên quan
- Tài liệu về chế độ nâng cao nằm tại Chế độ nâng cao.
Heartbeat
- Nội dung thăm dò Heartbeat là lời nhắc Heartbeat đã cấu hình (mặc định:
Read HEARTBEAT.md if it exists (workspace context). Follow it strictly. Do not infer or repeat old tasks from prior chats. If nothing needs attention, reply HEARTBEAT_OK.). Các chỉ thị nội tuyến trong tin nhắn Heartbeat được áp dụng như bình thường (nhưng tránh thay đổi giá trị mặc định của phiên từ Heartbeat). - Theo mặc định, việc gửi Heartbeat chỉ chuyển tải nội dung cuối cùng. Để gửi thêm tin nhắn
Thinkingriêng biệt (khi có), hãy đặtagents.defaults.heartbeat.includeReasoning: truehoặcagents.list[].heartbeat.includeReasoning: truetheo từng tác nhân.
Giao diện trò chuyện web
- Khi trang tải, bộ chọn mức suy nghĩ của trò chuyện web phản ánh mức đã lưu của phiên từ kho lưu trữ/cấu hình phiên đầu vào.
- Việc chọn một mức khác sẽ ghi ngay giá trị ghi đè của phiên qua
sessions.patch; thao tác này không chờ đến lần gửi tiếp theo và không phải là giá trị ghi đèthinkingOncechỉ dùng một lần. - Nếu gửi khi các thay đổi đối với bộ chọn mô hình, quá trình suy luận hoặc tốc độ vẫn đang được áp dụng, hệ thống sẽ chờ mọi bản vá bộ chọn đang chờ xử lý; nếu một thay đổi thất bại, tin nhắn sẽ không được gửi để có thể xem xét.
- Tùy chọn đầu tiên luôn là lựa chọn xóa giá trị ghi đè. Nó hiển thị
Inherited: <resolved level>, bao gồmInherited: Offkhi mức suy nghĩ kế thừa bị tắt. - Các lựa chọn tường minh trong bộ chọn sử dụng trực tiếp nhãn mức tương ứng, đồng thời giữ nguyên nhãn nhà cung cấp khi có (ví dụ:
Maximumcho tùy chọnmaxcó nhãn nhà cung cấp). - Bộ chọn sử dụng
thinkingLevelsdo hàng phiên/giá trị mặc định của gateway trả về, trong khithinkingOptionsđược giữ lại dưới dạng danh sách nhãn cũ. Giao diện trình duyệt không duy trì danh sách biểu thức chính quy riêng cho nhà cung cấp; các Plugin sở hữu tập hợp mức dành riêng cho từng mô hình. /think:<level>vẫn hoạt động và cập nhật cùng một mức phiên đã lưu, vì vậy các chỉ thị trò chuyện và bộ chọn luôn đồng bộ.
Hồ sơ nhà cung cấp
- Các Plugin nhà cung cấp có thể cung cấp
resolveThinkingProfile(ctx)để xác định các mức được mô hình hỗ trợ và mức mặc định. - Các Plugin nhà cung cấp làm proxy cho mô hình Claude nên tái sử dụng
resolveClaudeThinkingProfile(modelId)từopenclaw/plugin-sdk/provider-model-sharedđể danh mục Anthropic trực tiếp và danh mục proxy luôn đồng bộ. - Mỗi mức hồ sơ có một
idchuẩn tắc được lưu (off,minimal,low,medium,high,xhigh,adaptive,maxhoặcultra) và có thể bao gồm mộtlabelđể hiển thị. Các nhà cung cấp nhị phân sử dụng{ id: "low", label: "on" }. - Các hook hồ sơ nhận những dữ kiện danh mục đã hợp nhất khi có, bao gồm
reasoning,compat.thinkingFormatvàcompat.supportedReasoningEfforts. Chỉ dùng các dữ kiện đó để cung cấp hồ sơ nhị phân hoặc tùy chỉnh khi hợp đồng yêu cầu đã cấu hình hỗ trợ nội dung tương ứng. - Các Plugin công cụ cần xác thực một giá trị ghi đè suy nghĩ tường minh nên sử dụng
api.runtime.agent.resolveThinkingPolicy({ provider, model, agentRuntime })cùng vớiapi.runtime.agent.normalizeThinkingLevel(...); chúng không nên duy trì danh sách mức riêng theo nhà cung cấp/mô hình. TruyềnagentRuntimekhi công cụ sở hữu đường dẫn thực thi, chẳng hạn như một lượt chạy luôn được nhúng. - Các Plugin công cụ có quyền truy cập vào siêu dữ liệu mô hình tùy chỉnh đã cấu hình có thể truyền
catalogvàoresolveThinkingPolicyđể các lựa chọn tham giacompat.supportedReasoningEffortsđược phản ánh trong quá trình xác thực phía Plugin. - Các hook cũ đã phát hành (
supportsXHighThinking,isBinaryThinkingvàresolveDefaultThinkingLevel) vẫn được giữ làm bộ điều hợp tương thích, nhưng các tập hợp mức tùy chỉnh mới nên sử dụngresolveThinkingProfile. - Các hàng/giá trị mặc định của Gateway cung cấp
thinkingLevels,thinkingOptionsvàthinkingDefaultđể các máy khách ACP/trò chuyện hiển thị cùng ID và nhãn hồ sơ mà quá trình xác thực khi chạy sử dụng.