DeepSeek-V4这次真的有点东西。4月24日发布的这个预览版,一上来就甩出两大杀器——Pro和Flash版本,直接支持百万token超长上下文。最狠的是技术优化,推理FLOP直接降了73%,KV缓存内存占用更是砍了90%,这波操作直接让计算资源压力小了一大截。

  性能炸裂但幻觉有点多
  从Artificial Analysis的测试来看,V4-Pro在推理能力上拿了52分,比前代V3.2涨了10分,直接冲到全球开源推理模型的第二把交椅,仅次于Kimi K2.6。V4-Flash虽然弱一点,但也有47分,性能对标Claude Sonnet 4.6,算是中高端里的狠角色。智能体任务表现更猛,V4-Pro直接干到开源模型第一,连Kimi和GLM-5.1都被甩在后面。

  不过问题也挺明显——知识储备升级了,但幻觉发生率飙升。V4-Pro的幻觉率94%,V4-Flash更是96%,几乎到了“不懂也硬编”的地步。这玩意儿用起来得小心,别被它一本正经的胡说八道带沟里。

  成本是个双刃剑
  运行成本方面,V4-Pro比Claude Opus便宜四分之三,但对比其他开源模型还是贵,测评花了1071美元,比Kimi K2.6还高。关键它还是个“Token吞噬兽”,标准测评里光V4-Pro就吃了1.9亿Token,Flash版更夸张,2.4亿Token砸进去。虽然定价低,但架不住用量大啊。

  华为合作才是真亮点
  海外最关注的反而技术之外的事——DeepSeek和华为绑定了。官方明说Pro版现在算力吃紧,等下半年昇腾950超节点量产,价格会跳水。技术报告里还提到,V4在华为昇腾NPUs上跑出了1.5-1.96倍的加速效果,华为也立马官宣全系支持DeepSeek-V4。高盛分析师直接点破:这意味着中国顶级大模型能完全用国产芯片跑了,国产AI硬件生态这次真支棱起来了。

  英伟达老黄之前就预警过这事,说“DeepSeek要优先适配华为,对美国就是灾难”。现在看果然应验——虽然V4也能用英伟达显卡,但专门为昇腾优化的版本一出,在高端算力卡脖子的背景下,英伟达的主动权肯定被动摇。

  不过市场反应比去年冷静多了,没有重现R1发布时美股暴跌的场面。分析师说大家早习惯了中国AI的竞争力,现在更关心的是DeepSeek这波操作直接把国内其他开源模型都划成了竞品。布鲁金斯学会的研究员说得实在:V4没造出“R1时刻”,只因外界对中国AI的期待值早就拉满了。

追加内容

本文作者可以追加内容哦 !