Skip to main content
ds4 透過本機 Metal 後端提供 DeepSeek V4 Flash,並具備與 OpenAI 相容的 /v1 API。OpenClaw 透過通用 openai-completions 提供者系列連線至 ds4。 ds4 並非 OpenClaw 隨附的提供者外掛。請在 models.providers.ds4 下進行設定,然後選取 ds4/deepseek-v4-flash

需求

  • 支援 Metal 的 macOS。
  • 可正常運作且包含 ds4-server 與 DeepSeek V4 Flash GGUF 檔案的 ds4 簽出。
  • 足以容納所選上下文的記憶體;較大的 --ctx 值會在伺服器啟動時配置更多 KV 記憶體。
OpenClaw 代理程次包含工具結構描述與工作區上下文。像 --ctx 4096 這樣極小的上下文可能通過直接 curl 測試,卻會使完整代理執行因 500 prompt exceeds context 而失敗。代理與工具煙霧測試請至少使用 --ctx 32768。 只有在記憶體充足且要啟用 ds4 Think Max 時,才使用 --ctx 393216

快速入門

1

啟動 ds4-server

<DS4_DIR> 替換為 ds4 簽出路徑。
2

驗證與 OpenAI 相容的端點

回應應包含 deepseek-v4-flash
3

新增 OpenClaw 提供者設定

新增完整設定中的設定,然後執行一次性模型 檢查:

完整設定

ds4 已在 127.0.0.1:18000 上執行時,請使用此設定。
請讓 contextWindowds4-server --ctx 保持一致。除非刻意讓 OpenClaw 要求的輸出少於伺服器預設值,否則請讓 maxTokens--tokens 保持一致。

隨選啟動

OpenClaw 可只在選取 ds4/... 模型時啟動 ds4。請將 localService 新增至同一個提供者項目:
command 必須是絕對可執行檔路徑。不會使用 Shell 查找或展開 ~。所有 localService 欄位請參閱本機模型服務

Think Max

只有在下列兩項皆為真時,ds4 才會套用 Think Max:
  • ds4-server--ctx 393216 或更高的值啟動。
  • 要求使用 reasoning_effort: "max"(或對應的 ds4 推理強度欄位)。
若執行如此大的上下文,請同時更新伺服器旗標與 OpenClaw 模型 中繼資料:

測試

略過 OpenClaw 的直接 HTTP 檢查:
OpenClaw 模型路由(與快速入門檢查相同):
完整代理與工具呼叫煙霧測試,上下文至少為 32768:
預期結果:
  • executionTrace.winnerProviderds4
  • executionTrace.winnerModeldeepseek-v4-flash
  • toolSummary.calls 至少為 1
  • finalAssistantVisibleTexttool-ok 開頭

疑難排解

ds4 未執行,或未繫結至 baseUrl 中的主機/連接埠。請啟動 ds4-server,然後重試:
設定的 --ctx 對 OpenClaw 程次而言太小。請提高 ds4-server --ctx,然後更新 models.providers.ds4.models[].contextWindow 以保持一致。使用工具的完整代理程次所需上下文,遠多於直接傳送單一訊息的 curl 要求。
只有當 --ctx 至少為 393216,且要求指定 reasoning_effort: "max" 時,ds4 才會使用 Think Max。較小的上下文會退回高強度 推理。
ds4 具有 Metal 冷啟駐留與模型預熱階段。當 OpenClaw 隨選啟動伺服器時,請設定 localService.readyTimeoutMs: 300000

相關內容

本機模型服務

在模型要求之前隨選啟動本機模型伺服器。

本機模型

選擇並操作本機模型後端。

模型提供者

設定提供者參照、驗證與容錯移轉。

DeepSeek

原生 DeepSeek 提供者行為與思考控制。