/v1 API 提供本機模型。OpenClaw 透過通用 openai-completions 轉接器與其通訊。
開始使用
1
使用模型啟動 inferrs
2
確認伺服器可連線
3
新增 OpenClaw 提供者項目
新增明確的提供者項目,並將預設模型指向該項目。請參閱下方的設定範例。
完整設定範例
在本機inferrs 伺服器上執行 Gemma 4:
隨需啟動
只有選取inferrs/... 模型時,OpenClaw 才能自行啟動 inferrs。請將 localService 新增至同一個提供者項目:
command 必須是絕對路徑。請在閘道主機上執行 which inferrs,並使用該路徑。完整欄位參考:本機模型服務。
進階設定
requiresStringContent 為何重要
requiresStringContent 為何重要
某些
inferrs Chat Completions 路由僅接受字串 messages[].content,不接受結構化的內容部分陣列。Gemma 與工具結構描述的注意事項
Gemma 與工具結構描述的注意事項
某些 這可降低較嚴格本機後端的提示詞負荷。若微型直接請求仍可運作,但一般 OpenClaw 代理程式回合持續在
inferrs + Gemma 組合可接受小型的直接 /v1/chat/completions 請求,但在完整的 OpenClaw 代理程式執行階段回合中會失敗。請先嘗試停用工具結構描述介面:inferrs 內當機,請將其視為上游模型或伺服器限制,而非 OpenClaw 傳輸問題。手動冒煙測試
手動冒煙測試
完成設定後,請測試這兩層:若第一個命令可運作,但第二個失敗,請參閱下方的疑難排解。
代理式行為
代理式行為
由於
inferrs 使用通用 openai-completions 轉接器(而非 openai-responses),因此不會套用僅限原生 OpenAI 的請求塑形:不會傳送 service_tier、Responses store、提示詞快取提示,也不會傳送 OpenAI 推理相容性承載資料的塑形。疑難排解
curl /v1/models 失敗
curl /v1/models 失敗
inferrs 未執行、無法連線,或未繫結至你所設定的主機或連接埠。請確認伺服器已啟動,並正在該位址上監聽。messages[].content 預期為字串
messages[].content 預期為字串
請在模型項目中設定
compat.requiresStringContent: true(請參閱上方)。直接呼叫 /v1/chat/completions 成功,但 openclaw infer model run 失敗
直接呼叫 /v1/chat/completions 成功,但 openclaw infer model run 失敗
請設定
compat.supportsTools: false 以停用工具結構描述介面(請參閱上方的 Gemma 注意事項)。inferrs 在較大的代理程式回合中仍會當機
inferrs 在較大的代理程式回合中仍會當機
若結構描述錯誤已消失,但
inferrs 在較大的代理程式回合中仍會當機,請將其視為上游 inferrs 或模型限制。請降低提示詞負荷,或切換後端或模型。相關內容
本機模型
使用本機模型伺服器執行 OpenClaw。
本機模型服務
為已設定的提供者隨需啟動本機模型伺服器。
閘道疑難排解
對通過探測但代理程式執行失敗的本機 OpenAI 相容後端進行偵錯。
模型選擇
所有提供者、模型參照及容錯移轉行為的概覽。