经过近三个月的等待,DeepSeek V4 正式版可能最早于明天发布,最迟也将在几天内亮相。
目前,部分用户已获得 DeepSeek V4 (GA) 的灰度测试权限,该版本包含 DeepSeek V4 Flash 和 DeepSeek V4 Pro 两个版本。
DeepSeek V4 "满血版" 备受期待
用户可以通过观察模型的思维链 (CoT) 是否使用第一人称代词“I'm”或“I'll”来判断是否已获得 V4 GA 版的测试资格,而非旧版本的“Let me”。
在 Fable 5 和 GPT-5.6 Sol 等模型竞争的背景下,业界对 DeepSeek V4 的发布寄予厚望。
开发者 Pankaj Kumar 在体验后评价称,DeepSeek V4 的整体表现接近 Opus 4.8 级别,编码能力可与 GPT-5.6 Sol 相媲美,Agent 能力得到显著提升,3D 和 SVG 生成效果也大有改善。不过,他指出 V4 完成相同任务所需的迭代轮数多于 Fable 5。他认为 V4 在当前市场环境下可能难以超越 Kimi K3,但价格将更具优势。若其性能与价格相符,DeepSeek V4 有望重现“DeepSeek时刻”。
首轮测试结果引关注
DeepSeek V4 (GA) 的首轮测试演示已开始在网上流传,引发了褒贬不一的评价。有人认为其性能足以媲美 Claude 5,但也有开发者指出 Pro 版与 Flash 版的性能差距不大。
由 V4 Pro 生成的 3D 模拟射击游戏演示,展示了其操控攻城弩车进行打靶训练的核心玩法和完善的 UI 功能。
此外,V4 正式版还生成了一款融合《我的世界》与《无人深空》风格的 HTML 游戏,可玩性较高。
另一款经典的“割绳子”游戏也由 V4 一次性生成。
其他 V4 生成的演示包括 Xbox 手柄 SVG 测试和游戏生成。
引入 "峰谷计费" 模式,性价比依旧突出
DeepSeek V4 的价格策略被认为是其再次创造“DeepSeek时刻”的关键因素。爆料显示,其性能可能不是最顶尖,但价格将显著低于竞争对手。
DeepSeek 在上月底向 API 用户发送邮件,确认 V4 正式版将于 7 月中旬上线,并同步调整 API 定价,引入“峰谷计费”模式。
DeepSeek-V4-Pro 的百万输出 tokens 定价为:平日 0.87 美元,高峰时段 1.74 美元;缓存未命中的输入为 0.435 美元。
DeepSeek-V4-Flash 的定价更为激进:百万输出 0.28 美元,高峰时段 0.56 美元;缓存命中的输入仅为 0.0028 美元。
这意味着,以低价著称的 DeepSeek 首次在其算力服务中引入了动态定价。虽然对个人用户影响有限,但对于需要长时间运行 Agent 的团队而言,需要重新评估成本。
不过,缓存命中的价格依然极低,通过将批量任务、评测跑分和数据生成安排在非高峰时段,仍可有效控制成本。
与 Fable 5 百万输出 50 美元的定价相比,V4 在性价比方面仍具备显著优势,其性能已达到 Opus 级别。DeepSeek 官方在 V4 预览版发布时公布的数据显示,DeepSeek-V4-Pro-Max 在 SWE-bench Verified 测试中,与 Claude Opus 4.6 Max 仅差 0.2 个百分点,但价格却只有后者的七分之一。然而,在长上下文检索、专业软件工程及部分知识推理方面,Opus 仍保持领先。
值得注意的是,deepseek-chat 和 deepseek-reasoner 这两个模型名称将于 7 月 24 日正式下线。
经过三个月的期待,“靴子”终于要落地了。从目前披露的信息来看,V4 可能并非在所有方面都占据第一的“全能型”模型。面对 Fable 5、GPT-5.6 Sol 和 Kimi K3 的竞争,V4 依靠纯粹的性能优势颠覆市场难度较大。
但 DeepSeek 一贯的策略并非仅依赖于性能。其核心竞争力在于将 Opus 级别的能力,以七分之一的价格提供。即使引入了“峰谷计费”,在动辄百万 Token 需花费数十美元的巨头面前,V4 依然是极具竞争力的“价格屠夫”。
1 条留言
热情旅友分享
2026年5月10日能与您分享我们的旅行发现,我们感到无比荣幸!如果您对我们的内容有任何宝贵的意见或建议,欢迎随时通过我们的官方渠道与我们取得联系。我们非常期待听到您的声音,与您一同成长。
留下您的足迹