Skip to main content
models.providers.<id>.localService 會視需要啟動由提供者擁有的本機模型伺服器。當模型或嵌入請求選取該提供者時,OpenClaw 會探測健康狀態端點;若服務未執行,便啟動程序並等待就緒,接著傳送請求。使用此功能可避免讓昂貴的本機伺服器全天候持續執行。

運作方式

  1. 模型或嵌入請求會解析至已設定的提供者。
  2. 若該提供者具有 localService,OpenClaw 會探測 healthUrl
  3. 探測成功時,OpenClaw 會使用已在執行的伺服器。
  4. 探測失敗時,OpenClaw 會使用 args 產生 command
  5. OpenClaw 會輪詢健康狀態端點,直到 readyTimeoutMs 到期。
  6. 請求會透過一般的模型或嵌入傳輸機制處理。
  7. 若程序由 OpenClaw 啟動,且已設定 idleStopMs,則最後一個進行中的請求閒置達該段時間後,OpenClaw 會停止程序。
OpenClaw 不會為此安裝 launchd、systemd、Docker 或任何常駐程式。此伺服器只是第一個需要它的 OpenClaw 程序所建立的一般子程序。 系統會依每組已設定的提供者及命令/引數/環境變數集合依序執行啟動,因此對同一服務發出的並行聊天與嵌入請求不會產生重複的伺服器。每個請求都會保有自己的租約,直到回應處理完成,因此閒置關閉會等待所有進行中的模型與嵌入請求結束。已設定的提供者別名仍維持彼此獨立:兩個別名可指向不同的 GPU 主機,而不會合併至相同的 Ollama、LM Studio 或 OpenAI 相容轉接器 ID。 若另一個 OpenClaw 程序已在相同的 healthUrl 上執行健康的伺服器,此程序會重複使用該伺服器,但不會接管它(每個程序只管理自己啟動的子程序)。啟動與結束記錄包含有長度限制且經遮蔽的子程序輸出尾段,以及計時和結束詳細資料;絕不會輸出已設定的環境變數值。

設定結構

請在提供者項目(而非 localService)上設定 timeoutSeconds,以免緩慢的冷啟動與長時間生成觸發預設的模型請求逾時。只要伺服器的就緒狀態不是公開於基礎 URL 上的 /models,就應明確設定 healthUrl

欄位

Inferrs 範例

Inferrs 是自訂的 OpenAI 相容 /v1 後端,因此相同的 localService API 可搭配 inferrs 提供者項目使用:
請將 command 替換為在執行 OpenClaw 的機器上執行 which inferrs 所得到的結果。完整的 Inferrs 設定:Inferrs

ds4 範例

完整設定、情境大小調整與驗證命令:ds4

相關內容

本機模型

本機模型設定、提供者選擇與安全指引。

Inferrs

透過 Inferrs OpenAI 相容本機伺服器執行 OpenClaw。