DeepSeek 于周三发布了其旗舰产品的最终版本,但没有发布任何博客文章,也没有任何公告。说明是一个表格单元格:API 定价页面上列出的“deepseek-v4-pro”型号版本现在显示为 DeepSeek-V4-Pro-0813。
使用该模型的成本约为每百万个令牌(模型可以处理的信息的基本单位)输入和输出 0.435 美元和 0.87 美元。因此定价结构保持不变,但改变的是下面的权重。

Deepseek V4 Pro 自 4 月份以来一直处于流行状态,价格比 GPT-5 Pro 低 98%,每个测试它的独立实验室都在测试预览版。 DeepSeek said so itself on July 31, when it pushed V4-Flash to general availability and noted that the Pro API was “unchanged” with the official release to “follow soon.”开源 AI 项目的首选存储库 Hugging Face 上的模型卡仍然将 V4 系列描述为“预览版本”。
因此,广泛流传的分数描述了 DeepSeek 被认为尚未完成的构建。公司外部尚未对 0813 进行独立基准测试。
DeepSeek 的表格声称什么
该公司发布了 10 个代理基准的比较。在《神鬼寓言 5》或其他游戏有优势的八个方面,差距很小。
平均《神鬼寓言 5》在基准测试中的相对领先优势为 5.3%。 Strip out Humanity’s Last Exam without tools—where DeepSeek scores 42.7 against 53.3, a 10.6% gap that skews everything—and the remaining rows average 2.8%.
双方的定价都是公开的,这就是比较不接近的地方。 《神鬼寓言 5》每百万输入代币运行 10 美元,每百万输出代币运行 50 美元。 V4 Pro 的运行价格为 0.435 美元和 0.87 美元,缓存输入的价格为 0.003625 美元。按混合费率为 30 美元兑 0.65 美元,大约是成本的 46 倍,即 4,600%。当你经营一家企业并大规模使用人工智能工具时,这种传播就很重要。
每完成一个任务的成本就更高,因为《神鬼寓言 5》思考的时间更长,写的也更多。 Artificial Analysis 测算,每个基准任务的价格为 3.15 美元,而 V4-Flash 的价格为 3 美分,大约便宜 105 倍。 Hugging Face 首席执行官 Clément Delangue 表示,每项任务的价差为 31 美元以上,而每项任务的价差约为 0.04 美元。 0813 尚不存在每个任务的数据。
Anthropic 自己的产品阵容使溢价变得复杂。在大多数基准测试中,《Claude Opus 5》的得分都超过《神鬼寓言 5》,而价格却只有《神鬼寓言 5》的一半。
DeepSeek 自己在尚未发布的基础设施上对这些进行了评分。其 7 月份的说明指定 DeepSeek Harness 最小模式“即将发布”,以最大的努力和高度的创造力运行。十个基准测试中的两个,DSBench-FullStack 和 DSBench-Hard,是内部测试集,没有公共排行榜可供检查。
但行进方向是一致的。中国的开放权重实验室不断以极低的价格在美国边境的几个点内登陆——Kimi K3 在发布时击败了《神鬼寓言 5》和 GPT-5.6 Sol,而 DeepSeek 和小米已经将边境成本削减了 99%,而美国实验室却采取了相反的做法。 DeepSeek 的权重已获得 MIT 许可并在 Hugging Face 上,因此只需下载即可进行独立验证。