7月31日,DeepSeek-V4-Flash正式版API悄然上線公測,標誌着這家國產大模型公司在Agent賽道上邁出關鍵一步。與以往"Pro強、Flash弱"的分層邏輯不同,此次更新後,Flash正式版在多項Agent基準測試中的表現已逼近甚至超越三個月前的V4-Pro預覽版。

官方數據顯示,V4-Flash正式版在Terminal Bench2.1上取得82.7分,Cybergym達76.7分,Toolathlon verified爲70.3分。值得注意的是,該模型總參數2840億,激活參數僅130億,與V4-Pro(激活490億)相差近一個數量級。DeepSeek明確表示,此次更新"僅重新進行了後訓練",模型結構完全不變。這意味着,通過訓練方法和數據質量的優化,輕量模型在特定任務上正縮小與旗艦模型的差距。

DeepSeek

此次升級的另一看點,是自研Agent框架DeepSeek Harness首次以正式命名亮相。同時,V4-Flash原生支持OpenAI力推的Responses API格式,並針對性適配Codex,開發者可低成本將OpenAI生態的Agent應用遷移至DeepSeek平臺。

戰略意圖十分清晰:用高性價比的輕量模型切入Agent應用市場。Agent場景對推理速度和成本極度敏感,Flash的低價優勢在反覆調用工具的多輪任務中將形成顯著競爭力。

此次發佈距離DeepSeek完成超500億元首輪融資不足兩月,公司估值已攀升至約710億美元。在資本加持下,DeepSeek正加速從"不融資不上市"轉向商業化衝刺。隨着Pro正式版即將到來,Agent戰爭的大幕已然拉開。