根據 BlockBeats 報導,8 月 15 日,使用者發現,呼叫相同的 deepseek-v4-pro API 端點,會產生三種截然不同的推理風格:有些回應以「讓我」開頭(類似 V4 Pro Preview),有些以「使用者想要我」開頭(類似 V4 Flash),另一些則大量使用「我們」。最初的推測是,DeepSeek 運行著多個隱藏模型,並透過路由機制進行分流。然而,對 DeepSeek Harness 原始碼的分析,以及 8 月 10 日的一項關鍵提交更新——「修復(預設):讓最小化代理程式與 RL 組成對齊」——顯示,這些差異可能源自代理程式環境的變化,而非不同的模型權重。Minimal 預設採用最精簡的系統提示詞、持久化 Bash 環境,以及符合 RL 訓練條件的特定工具,與 Standard 設定存在根本差異。
社群測試證實了這一點:相同的 V4 Pro 在 Standard 環境下獲得 91 分,在 PTC 下獲得 92 分,在 Minimal 下則獲得 99/96 分。進一步測試顯示,模型在初始化期間首次接觸系統提示詞與工具結構描述的方式,會大幅影響後續效能。DeepSeek 尚未正式確認這些發現;其 API 文件將 deepseek-v4-pro 列為 0813 版本,但未揭露多模型路由機制。