/v1 API。OpenClaw 透過通用 openai-completions 提供者系列連線至 ds4。
ds4 並非 OpenClaw 隨附的提供者外掛。請在
models.providers.ds4 下進行設定,然後選取 ds4/deepseek-v4-flash。
需求
- 支援 Metal 的 macOS。
- 可正常運作且包含
ds4-server與 DeepSeek V4 Flash GGUF 檔案的 ds4 簽出。 - 足以容納所選上下文的記憶體;較大的
--ctx值會在伺服器啟動時配置更多 KV 記憶體。
快速入門
1
啟動 ds4-server
將
<DS4_DIR> 替換為 ds4 簽出路徑。2
驗證與 OpenAI 相容的端點
deepseek-v4-flash。3
新增 OpenClaw 提供者設定
新增完整設定中的設定,然後執行一次性模型
檢查:
完整設定
ds4 已在127.0.0.1:18000 上執行時,請使用此設定。
contextWindow 與 ds4-server --ctx 保持一致。除非刻意讓 OpenClaw 要求的輸出少於伺服器預設值,否則請讓 maxTokens 與
--tokens 保持一致。
隨選啟動
OpenClaw 可只在選取ds4/... 模型時啟動 ds4。請將
localService 新增至同一個提供者項目:
command 必須是絕對可執行檔路徑。不會使用 Shell 查找或展開
~。所有 localService 欄位請參閱本機模型服務。
Think Max
只有在下列兩項皆為真時,ds4 才會套用 Think Max:ds4-server以--ctx 393216或更高的值啟動。- 要求使用
reasoning_effort: "max"(或對應的 ds4 推理強度欄位)。
測試
略過 OpenClaw 的直接 HTTP 檢查:executionTrace.winnerProvider為ds4executionTrace.winnerModel為deepseek-v4-flashtoolSummary.calls至少為1finalAssistantVisibleText以tool-ok開頭
疑難排解
curl /v1/models 無法連線
curl /v1/models 無法連線
ds4 未執行,或未繫結至
baseUrl 中的主機/連接埠。請啟動
ds4-server,然後重試:500 提示超出上下文
500 提示超出上下文
設定的
--ctx 對 OpenClaw 程次而言太小。請提高
ds4-server --ctx,然後更新 models.providers.ds4.models[].contextWindow
以保持一致。使用工具的完整代理程次所需上下文,遠多於直接傳送單一訊息的 curl 要求。Think Max 未啟用
Think Max 未啟用
只有當
--ctx 至少為 393216,且要求指定
reasoning_effort: "max" 時,ds4 才會使用 Think Max。較小的上下文會退回高強度
推理。第一次要求很慢
第一次要求很慢
ds4 具有 Metal 冷啟駐留與模型預熱階段。當 OpenClaw 隨選啟動伺服器時,請設定
localService.readyTimeoutMs: 300000。相關內容
本機模型服務
在模型要求之前隨選啟動本機模型伺服器。
本機模型
選擇並操作本機模型後端。
模型提供者
設定提供者參照、驗證與容錯移轉。
DeepSeek
原生 DeepSeek 提供者行為與思考控制。