性能逼近 Claude、价格仅为其 1/46:DeepSeek V4 Pro 正式版发布

DeepSeek 正式发布 V4 Pro 正式版,自测数据显示性能仅比 Claude Fable 5 低约 5%,价格却便宜约 46 倍。编码与代理能力多项基准大幅提升,以性价比向顶级模型发起冲击。

DeepSeek 再次以性价比向顶级模型叫阵。近日,DeepSeek 将 deepseek-v4-pro 换上了「0813」正式版,这是它自 4 月以来以预览形式运行的模型的正式发布。DeepSeek 公布的对照表显示,其性能仅比 AnthropicClaude Fable 5 差约 5%,价格却只有后者的约四十六分之一。

据 DeepSeek 公布的基准测试,这款具备 100 万 token 上下文的 V4 Pro,在九项代理(agent)基准测试中平均落后 Claude Fable 5 约 5.3%,其中两项还实现反超。价格方面,DeepSeek 每百万输入 token 收费约 0.43 美元,输出 0.87 美元;而 Claude Fable 5 为每百万输入 10 美元、输出 50 美元。换算下来,DeepSeek 的成本大约只有 Claude Fable 5 的四十六分之一。不过,这组「差 5%、便宜 46 倍」的对照是 DeepSeek 自行公布,实际表现仍有待第三方验证。

相较于此前的预览版,正式版在多项硬指标上进步明显:Terminal Bench 2.1 从 72.1 升至 87.9,DeepSWE 从 12.8 跃至 62.7,DSBench-FullStack 也从 41.8 拉至 71.1,编码与代理能力均有显著提升。这让 DeepSeek 加入了近期以低价对标前沿模型的混战。此前,xAI 也发布了 Grok 4.6,主打同价升级、对标前沿模型。随着开源与低价阵营持续逼近顶级闭源模型的性能,OpenAI、Anthropic 的定价压力将日益增大。

免责声明:本文提供的信息不是交易建议。BlockWeeks.com不对根据本文提供的信息所做的任何投资承担责任。我们强烈建议在做出任何投资决策之前进行独立研究或咨询合格的专业人士。

(0)
区块链小猫的头像区块链小猫作者
上一篇 20小时前
下一篇 19小时前

相关推荐

发表回复

登录后才能评论
分享本页
返回顶部