Deepseek 提升 AI 能力,開源軟體並升級模型
Deepseek 近期宣布其旗艦產品已經脫離測試階段,同時也將其專有代理軟體以開源方式釋出,並宣布了更高的 API 價格。這一系列的動作,旨在提升 Deepseek 的 AI 能力,同時也為開發者提供了更多的選擇。
升級模型
Deepseek-v4-pro 端點現在提供了 build V4-Pro-0813。該模型的名稱、參數數量以及一百萬字元的上下文窗口保持不變,Deepseek 表示現有的整合將無需任何調整即可繼續運行。在應用程序和網頁上,模型可在「專家模式」下使用。新增的功能包括對 OpenAI Responses API 的原生支援,同時也整合了 Codex。推理努力可以設定為三個級別:低、中和最大,Deepseek 推薦使用中等設定以進行日常代理使用。
表現提升
根據 Deepseek 自己的比較表,Terminal Bench 2.1 分數從 72.1 跳升到 87.9,DeepSWE 分數從 12.8 跳升到 62.7。在多個代理基準測試中,該模型超越了 Claude Opus 4.8。人工分析支持這一提升,但也將其放在適當的背景下。V4-Pro 從 45 升到 53 的智力指數,與 GLM-5.2 相同。然而,這仍然落後於 Muse Spark 的 57、Qwen 3.8 Max 的 58 和 Kimi K3 的 60。Claude Opus 5 排名最高,達到 63 分。Deepseek 尚未發布新版本的權重,四月份的預覽版本仍然在 Hugging Face 上。
開源軟體
Deepseek Harness v0.1 以 MIT 授權的開發者預覽版本發布。該開源代理軟體被視為 OpenAI 的 Codex 和 Claude 的替代品。它建立在新發布的 Cordis 外掛系統上,所有功能都是可交換的外掛,從工具和沙盒到會話和用戶界面。連續的會話日誌記錄每個提示、每個工具調用和每個結果。運行可以恢復、分支和重播。
未來展望
Deepseek 的這一系列動作,無疑將會對 AI 領域產生深遠的影響。通過升級模型和開源軟體,Deepseek 為開發者提供了更多的選擇和工具,同時也提升了自己的競爭力。未來,AI 領域將會面臨更多的挑戰和機遇,Deepseek 的動作無疑將會為這一領域的發展做出重要的貢獻。同時,開發者也需要關注這一領域的發展,及時掌握最新的技術和工具,以便在未來的競爭中佔據優勢。
