DeepSeek V4 的正式版本可能最早在明天发布,最晚也不超过几天,这标志着用户们近三个月的等待即将结束。
目前,部分用户已经获得了 DeepSeek V4 (GA) 的灰度测试访问权限,该版本包含 DeepSeek V4 Flash 和 DeepSeek V4 Pro 两个版本。
对于用户如何判断自己是否已获得灰度测试资格,博主 AiBattle 提供了一种方法:观察模型在思维链(CoT)生成时是否使用第一人称代词,例如“I'm”或“I'll”,而非旧版本的“Let me”。
在 Fable 5 和 GPT-5.6 Sol 持续竞争的背景下,业界对 DeepSeek V4 的发布充满期待。
开发者 Pankaj Kumar 在体验后对 V4 的性能进行了评价,认为其整体表现接近 Opus 4.8,编码能力可媲美 GPT-5.6 Sol,并且 Agent 能力得到显著提升,3D 和 SVG 生成效果也有改善。不过,他指出 V4 完成同一任务所需的迭代轮数比 Fable 5 要多。他同时预测,V4 在当前市场环境中可能难以超越刚发布的 Kimi K3,但价格会更具优势。
DeepSeek V4 (GA) 的首批测试演示已开始流传,引发了不同的评价。一些人认为其性能可与 Claude 5 相媲美,但也有开发者指出 Pro 版与 Flash 版的性能差距并不明显。
演示内容包括:
DeepSeek V4 的一个重要变化是引入了“峰谷计费”模式,但价格仍被认为极具竞争力。
虽然性能可能并非顶尖,但价格将是其主要卖点。DeepSeek 在上个月底通知 API 用户,将于7月中旬上线 V4 正式版,并同步调整 API 定价,引入“峰谷计费”。
具体定价如下:
这是 DeepSeek 首次调整其一贯的低价策略。虽然对个人用户影响有限,但对需要长时间运行 Agent 的团队而言,将需要重新计算成本。
好消息是,缓存命中的价格依然很低,通过将批量任务、评测跑分等安排在非高峰时段,仍可有效控制成本。与 Fable 5 每百万输出 50 美元的定价相比,V4 在性价比上依然优势明显,尤其考虑到其 Opus 级别的性能。
在 V4 预览版发布时,官方数据显示 DeepSeek-V4-Pro-Max 在 SWE-bench Verified 测试中,仅比 Claude Opus 4.6 Max 低 0.2 个百分点,而价格仅为其七分之一。然而,在长上下文检索、专业软件工程和部分知识推理方面,Opus 仍保持领先。
此外,deepseek-chat 和 deepseek-reasoner 这两个旧模型名将于 7 月 24 日正式停用。
历经三个月的等待,DeepSeek V4 即将面世。从现有信息来看,V4 可能不会在所有方面都达到第一,面对 Fable 5、GPT-5.6 Sol 和 Kimi K3 的竞争,纯粹依靠性能取得突破难度较大。但 DeepSeek 的策略一直是以极具竞争力的价格提供接近顶尖的性能。即使引入了“峰谷计费”,V4 在与动辄数百万 Token 收费数十美元的巨头相比,依然保持着“价格屠夫”的优势。
1 条评论
江南体育用户
2026年6月15日欢迎您在此分享您对本文的任何想法、评论或提问。我们的专业编辑团队将认真阅读并及时回复,与您一同深入探讨体育世界的精彩与奥秘!
发表您的看法