
Deepseek 發佈 V4 Flash '0731' 預算 AI 模型,與 OpenAI 突破性成就接近
Deepseek最近發佈了V4 Flash "0731",這是一個預算AI模型的重大升級。根據人工智慧分析指數(Artificial Analysis Intelligence Index),新的版本得分為50分,比四月2026年發佈的上一版本V4 Flash多了10分。這使得它只落後於OpenAI的預算模型GPT-5.6 Luna一分,但其成本僅為OpenAI的60%,即使OpenAI已經實施了80%的價格削減。Deepseek的緩存折扣(cache discount)達到98%,遠高於業界標準的90%,這是造成成本差距的主要原因。該模型還使用了12%較少的字元(tokens)來處理任務。
預算AI模型的升級
Deepseek的V4 Flash "0731"模型在所有測試類別中都比上一版本有所改善,尤其是在代理任務(agentic tasks)中取得了最大的進步。在GDPval基準測試中,該模型的得分從1189點提升到1559點,顯示其在複雜的真實世界辦公室工作中的能力有所提高。另外,該模型的幻覺(hallucination)次數也減少了。V4 Flash "0731"的架構保持不變,總共有284億個參數(parameters),13億個活躍參數(active parameters),以及一個有一百萬字元的內容窗口(context window)。Deepseek已經在Hugging Face上以MIT授權(MIT license)方式公開了模型的權重。
未來展望
Deepseek的V4 Flash "0731"模型的發佈標誌著預算AI模型的又一次突破。隨著AI技術的不斷發展,預算AI模型的能力將越來越強大,價格也將越來越低。這對於需要使用AI技術的企業和個人來說是一個好消息,因為它們可以在不花費過多成本的情況下使用高品質的AI模型。同時,Deepseek的V4 Flash "0731"模型也為AI研究和開發提供了一個新的基礎,未來的AI模型將可能在此基礎上繼續改進和創新。因此,Deepseek的V4 Flash "0731"模型的發佈是一個值得關注的事件,它將對AI產業的發展產生重要的影響。