DeepSeek V4“满血版”曝光了,最快明天发布
经过近三个月的等待,DeepSeek V4 的正式版本可能最早在明天发布,最晚也将在几天内面世。
部分用户已提前获得了 DeepSeek V4 (GA) 的灰度测试权限,该版本包含 DeepSeek V4 Flash 和 DeepSeek V4 Pro 两个版本。
关于如何判断是否已获得 V4 GA 版的测试资格,有开发者分享了一个“验货口诀”:观察模型生成思维链(CoT)时是否使用第一人称代词,例如“I'm”或“I'll”,而非老版本的“Let me”。
在 Fable 5 和 GPT-5.6 Sol 持续竞争的背景下,业界对 DeepSeek V4 的期待值非常高。
开发者 Pankaj Kumar 在体验后对 V4 的性能进行了评价,认为其整体表现接近 Opus 4.8 水平,编码能力可与 GPT-5.6 Sol 相媲美,Agent 能力显著提升,在 3D 和 SVG 生成方面有明显进步。不过,他指出完成同一任务,V4 所需的迭代轮数比 Fable 5 要多。他预测 V4 可能难以超越刚发布的 Kimi K3,但价格会更具优势,若能实现,将是 DeepSeek 的又一次“高光时刻”。
目前,DeepSeek V4 (GA) 的首轮测试样本已开始在网络上流传,收到的反馈褒贬不一。有人认为其性能已能匹敌 Claude 5,但也有开发者指出 Pro 版本与 Flash 版本之间的性能差距并不显著。
已流出的 demo 展示了 V4 Pro 生成的 3D 模拟射击游戏,该游戏具备核心玩法和基础 UI 功能。此外,V4 还生成了一个结合了《我的世界》和《无人深空》元素的 HTML 混合游戏,以及经典的“割绳子”游戏。其他 demo 包括一个 Xbox 手柄 SVG 测试和游戏生成示例。
DeepSeek V4 的发布引入了“峰谷计费”模式,但仍保持了价格竞争力。
所有信息都指向 V4 的价格将远低于其性能水平。DeepSeek 在上月底向 API 用户发送邮件,确认将于 7 月中旬推出 V4 正式版,并同步调整 API 定价,引入“峰谷计费”。
具体而言,deepseek-v4-pro 的百万输出 tokens 在平时收费 0.87 美元,高峰时段为 1.74 美元;缓存未命中的输入平时为 0.435 美元。deepseek-v4-flash 的百万输出 tokens 平时为 0.28 美元,高峰时段为 0.56 美元,缓存命中的输入仅为 0.0028 美元。这意味着 DeepSeek 首次为其算力引入了分时计费机制。
此举对个人用户影响有限,但对于需要长时间运行 Agent 的团队而言,将需要重新计算成本。不过,缓存命中的价格依然较低,通过将批量任务、评测跑分和数据生成安排在非高峰时段,仍可有效控制成本。
与 Fable 5 百万输出 50 美元的定价相比,V4 在性价比方面依然极具吸引力,尤其考虑到其已达到 Opus 级别性能。在 V4 预览版发布时,官方数据显示 DeepSeek-V4-Pro-Max 在 SWE-bench Verified 测试中,仅以 0.2 个百分点的微弱差距落后于 Claude Opus 4.6 Max,而价格却仅为后者的七分之一。尽管在长上下文检索、专业软件工程和部分知识推理方面,Opus 仍保持领先。
值得注意的是,deepseek-chat 和 deepseek-reasoner 这两个旧模型名将于 7 月 24 日正式停止服务。
历经三个月的等待,DeepSeek V4 的发布终于临近。从现有信息来看,V4 可能并非在所有方面都拔得头筹,面对 Fable 5、GPT-5.6 Sol 和 Kimi K3 等强劲对手,仅凭性能难以实现“全项第一”。然而,DeepSeek 一贯的策略并非仅依靠纯粹的性能比拼。其核心竞争力在于以极具竞争力的价格提供接近 Opus 级别的能力,此次引入“峰谷计费”后,在与动辄数百万 Token 几十美元定价的巨头相比,V4 仍将是市场上的“价格屠夫”。
留下你的寶貴意見,與我們一同成長