趕在7月最後一天,DeepSeek終于拿出了V4正式版,首發的隻是V4 Flash-0731,Pro正式版要到8月初,會随着DeepSeek的Harness工具一起問世。
V4 Flash-0731發布之後,之前還因為DeepSeek跳票而把梁文鋒稱為小梁、梁白開的網友馬上恢複了梁聖的稱号,因為它的表現超過了預期,官方測試性能超過了GLM-5.2,比Opus 4.8低一些,部分測試甚至能追上後者。
那V4 Flash-0731到底有多強,網上已經有很多網友自發測試了,基本上符合官方的說法,性能表現相對它284B參數來說算得上是驚豔,比很多1000B萬億大模型都要強。
如果還看不懂V4 Flash-0731的性能水平,有網友用GPT分析彙總了AI性能排行榜Artificial Analysis上的數據,結合API定價做了詳細的對比,幾乎囊括了國内外常見的大模型了。

這個榜單很簡單,橫坐标是價位,越低越好,縱坐标是性能分數,越高越好,每個大模型還根據思考擋位做了區分。
大家不想挨個對比的話,可以隻看V4 Flash-0731的位置,位于它右下角的大模型意味着要麼性能不如V4 Flash-0731,要麼價格不如它。
簡單來說,右下角的那些國内的或者國外的大模型已經被V4 Flash-0731斬殺了,僥幸不被V4 Flash-0731斬殺的主要是兩種,一種是價格比它還低的,這裡面主要是GPT-5.6 Luna(low)、小米的MiMo-V2.5,前者剛剛降價80%,不然也會落入斬殺線範圍内。
小米的大模型之前就随着V4預覽版降價了,而且還是多模态的,有一些優勢,不過編程性能跟現在的V4 Flash-0731差了一截,猜測小米應該也要快要發布升級版了。
右上角不被V4 Flash-0731斬殺的大模型則是當前國内外AI巨頭的主力/旗艦大模型,包括Kimi K3、Fable 5、Opus 5、Opus 4.8、GPT-5.6 Sol等,而且需要思考擋位開到Max、High級别才可以靠性能優勢拉開與V4 Flash-0731的舉例,脫離危險區。
總的來說,這個圖表可以清晰地展示出V4 Flash-0731的能力區間,網友之前将DeepSeek定位于AI領域的斬殺線,這個概念還是很有趣且準确的,不論國内還是國外的大模型,性能超過了DeepSeek的大模型沒啥獎勵,但你要是連DeepSeek性能都追不上,那它超強的價格優勢會讓你很難受,拼價格無異于利潤自殺,不拼價格就會被吸走用戶。
以上這些還是V4 Flash-0731這個輕量級模型的能力,DeepSeek的殺手锏V4 Pro正式版還要再等幾天,而且還有自家配套的Agent軟件,考慮到其參數量是V4 Flash-0731的5倍左右,性能可期,搞不好會把斬殺線标準提升到Opus 5/GPT-5.6 Sol級别。
最後,V4 Flash-0731的命名又回到了去年R1那種版本号不變但加上日期後綴的風格了,意味着随着時間的推移,V4 Flash及Pro的後訓練還會加強,每隔兩三個月就要提升一次,友商也得跟上了。

免責聲明:本文僅代表作者個人觀點,與每日科技網無關。其原創性以及文中陳述文字和内容未經本站證實,對本文以及其中全部或者部分内容、文字的真實性、完整性、及時性本站不作任何保證或承諾,請讀者僅作參考,并請自行核實相關内容。
本網站有部分内容均轉載自其它媒體,轉載目的在于傳遞更多信息,并不代表本網贊同其觀點和對其真實性負責,若因作品内容、知識産權、版權和其他問題,請及時提供相關證明等材料并與我們聯系,本網站将在規定時間内給予删除等相關處理.

