快科技8月1日消息,赶在7月最后一天,DeepSeek终于拿出了V4正式版,首发的只是V4 Flash-0731,Pro正式版要到8月初,会随着DeepSeek的Harness工具一起问世。V4 Flash-0731发布之后,之前还因为DeepSeek跳票而把梁文锋称为小梁、梁白开的网友马上恢复了梁圣的称号,因为它的表现超过了预期,官方测试性能超过了GLM-5.2,比Opus 4.8低一些,部分测试甚至能追上后者。
那V4 Flash-0731到底有多强,网上已经有很多网友自发测试了,基本上符合官方的说法,性能表现相对它284B参数来说算得上是惊艳,比很多1000B万亿大模型都要强。如果还看不懂V4 Flash-0731的性能水平,有网友用GPT分析汇总了AI性能排行榜Artificial Analysis上的数据,结合API定价做了详细的对比,几乎囊括了国内外常见的大模型了。

DeepSeek V4正式版有多强:AI斩杀线名不虚传 性价比干掉大多数友商
这个榜单很简单,横坐标是价位,越低越好,纵坐标是性能分数,越高越好,每个大模型还根据思考挡位做了区分。大家不想挨个对比的话,可以只看V4 Flash-0731的位置,位于它右下角的大模型意味着要么性能不如V4 Flash-0731,要么价格不如它。简单来说,右下角的那些国内的或者国外的大模型已经被V4 Flash-0731斩杀了,侥幸不被V4 Flash-0731斩杀的主要是两种,一种是价格比它还低的,这里面主要是GPT-5.6 Luna(low)、小米的MiMo-V2.5,前者刚刚降价80%,不然也会落入斩杀线范围内。
小米的大模型之前就随着V4预览版降价了,而且还是多模态的,有一些优势,不过编程性能跟现在的V4 Flash-0731差了一截,猜测小米应该也要快要发布升级版了。右上角不被V4 Flash-0731斩杀的大模型则是当前国内外AI巨头的主力/旗舰大模型,包括Kimi K3、Fable 5、Opus 5、Opus 4.8、GPT-5.6 Sol等,而且需要思考挡位开到Max、High级别才可以靠性能优势拉开与V4 Flash-0731的举例,脱离危险区。
总的来说,这个图表可以清晰地展示出V4 Flash-0731的能力区间,网友之前将DeepSeek定位于AI领域的斩杀线,这个概念还是很有趣且准确的,不论国内还是国外的大模型,性能超过了DeepSeek的大模型没啥奖励,但你要是连DeepSeek性能都追不上,那它超强的价格优势会让你很难受,拼价格无异于利润自杀,不拼价格就会被吸走用户。以上这些还是V4 Flash-0731这个轻量级模型的能力,DeepSeek的杀手锏V4 Pro正式版还要再等几天,而且还有自家配套的Agent软件,考虑到其参数量是V4 Flash-0731的5倍左右,性能可期,搞不好会把斩杀线标准提升到Opus 5/GPT-5.6 Sol级别。最后,V4 Flash-0731的命名又回到了去年R1那种版本号不变但加上日期后缀的风格了,意味着随着时间的推移,V4 Flash及Pro的后训练还会加强,每隔两三个月就要提升一次,友商也得跟上了。

DeepSeek V4正式版有多强:AI斩杀线名不虚传 性价比干掉大多数友商
【本文结束】出处:快科技

0 留言