Kimi K3在全球AI圈掀起的关注尚未平息,DeepSeek的新动作便接踵而至。近日,一段DeepSeek V4正式版的测试视频在网络流出,引发了不少讨论。据多方消息推测,这款新模型有望在下周一正式发布——这个时间点恰好卡在K3热度仍高的窗口期,竞争意味不言自明。
从参与测试的人员反馈来看,V4的综合表现已经接近Claude Opus 4.8的水平。尤其在代理行为方面展现出了更好的执行能力,代码生成也相当稳健。颇为令人意外的是其在3D任务上的表现,有测试者直言这一项甚至明显优于Opus 4.8。
当然,也有更加大胆的观点出现。有博主在社交平台上表示,在某些测试用例中,DeepSeek V4甚至超过了Fable 5和GPT-5.6。坦率地说,这类横向对比往往说服力有限——不同模型在不同任务上各有所长,仅凭少数case就断言胜负并不严谨。但反过来看,能被拿来和这几个头部模型相提并论,本身已经说明了一些问题。
在思维链的呈现方式上,有测试者注意到V4的风格更接近Claude——不再堆叠大量原始代码,而是直接显示类似“编写核心功能”“构建主要场景”这样的高阶描述,对开发者而言更加清晰友好。
还有观点认为,V4在编码风格和迭代逻辑上可能大量借鉴了Fable模型的输出特征,两者在使用体验上颇为接近。不过这个判断是否准确,目前还难以验证。
从流出的测试视频来看,大部分内容以游戏场景为主。画面流畅度整体不错,交互逻辑也基本在线。有博主仅用极低成本就生成了一个游戏互动程序,生成的代码量相当可观,展示了V4在快速开发场景下的潜力。另一位测试者总结称,V4在3D游戏生成和编码质量方面表现良好,后期只需少量修复即可投入使用,性价比令人印象深刻。
关于具体上线时间,目前多方信息指向下周一。考虑到官方此前曾透露过7月中旬的时间窗口,这一推测具备较高的可信度。眼下Kimi K3刚刚发布,开源模型的讨论热度正高,确实是DeepSeek出手的好时机。
回顾过往,DeepSeek从来不是一家靠讲故事起家的公司。它的每一次亮相,靠的都是实打实的性价比和开源策略。倘若这次V4真能达到测试者所说的性能水平,同时价格继续低一个量级,那么它所引发的关注度未必会低于K3。过去两年,DeepSeek始终保持着自己的节奏——埋头研发,突然发版,然后以价格优势迅速切入市场。这一次,外界普遍预期也不会例外。
【免责声明】部分数据来源于网络公开报道及行业资讯,如有侵权,请及时与本网站联系,我们将第一时间予以删改。文中所涉观点、数据及分析仅代表小编个人观点,仅供参考,不构成任何投资建议、商业决策依据或法律承诺。投资有风险,决策需谨慎;任何单位或个人据此进行商业决策、经营行为所产生的风险,均自行承担。