有消息称,DeepSeek可能在下周一发布该模型。时间点很微妙,刚好卡在K3刷屏的当口。实测性能如何?有测试者直接说,DeepSeek V4正式版的性能达到了 Claude Opus 4.8 的水平。有几个维度,比如代理行为表现更好,编码能力稳健。最让人意外的是 3D 方向,远超 Opus 4.8。更激进的观点也有。有博主在推特上放话,在某些测试中,DeepSeek V4正式甚至压过了 Fable 5 和 GPT-5.6。说实话,这类横向对比我一直持保留态度。不同模型在不同任务上的表现差异很大,拿着某几个 case 说超过谁,说服力有限。但反过来看,能被拿来跟这几个顶流比,本身就说明了一些问题。流出来的测试视频大部分以游戏为主。总体来看,画面流畅度不错,交互逻辑也基本在线。还有一位博主coding了一个《鱿鱼游戏》的小游戏,总成本仅0.12美元,生成了3000行代码。另一位博主测试后给出自己的结论。DeepSeek V4正式版具有更好的3D游戏生成;强大的编码质量;仅需少量修复;令人难以置信的性价比。有测试者认为,DeepSeek V4正式版可能大量提炼了fable的编码风格和迭代行为,输出感觉上非常相似。不过,这个判断对不对,不好验证。还有人指出,DeepSeek V4正式版的思维链风格更加接近Claude,不再有成堆的代码,而是直接显示“编写核心功能”、““编写主要场景代码”这样的内容。
什么时候能用上?关于发布日期,目前的消息是可能最早下周一。此前,DeepSeek官方曾透露是7月中旬。所以下周一也算是合理推测。考虑到K3刚刚发布,开源模型的讨论度很高,现在确实是DeepSeek出手的好时机。
能不能带来DeepSeek时刻2.0?DeepSeek不是一个靠讲故事的公司。它每一次出手,都是靠实打实的性价比和开源策略打出来的。这次的模型如果真像测试者说的那样,逼近 Fable 和 GPT 的水平,价格还低一个量级,可能热度不会比K3低。过去两年,DeepSeek节奏一直很稳定,闷头干活,突然发模型,然后价格屠夫进场。这次,大概也不会例外。










