DeepSeek刚刚发布了可能是市场上最具成本效益的前沿AI模型。这家中国研究实验室的新模型V4-Flash可同时处理文本和图像,在推理和编程基准测试中与Anthropic的Claude Opus 4.8不相上下,而每次输出成本仅约0.28美元。Anthropic对类似任务收费约25至30美元。
该公司于2026年4月24日发布了DeepSeek-V4-Pro和V4-Flash的预览版本,这是其V4模型家族的最新成员。核心亮点在于多模态能力,即这些模型可以同时解读图像和文本提示。
V4-Flash背后的技术架构更有意思。该模型处理图像时仅约使用90个KV缓存条目,而Claude模型约为870个。KV缓存本质上相当于模型推理时的工作记忆。条目越少意味着计算开销越小,直接带来更低的成本和更快的处理速度。
DeepSeek模型还支持最高100万token的长上下文处理。同时兼容OpenAI和Anthropic的API,对于已经在这两个平台上开发的开发者来说,可以直接切换,非常方便。
紧随初始版本之后,DeepSeek还发布了V4-Flash-0731版本以及名为deepseek-v4-flash-vision-exp的实验性视觉模型,表明该实验室正在快速迭代其多模态能力。
不断扩大的成本差距。自2025年1月R1模型震动AI行业以来,DeepSeek一直在为此蓄力。那次发布确立了一种模式,并已不断优化:匹配或接近前沿性能,同时在价格上大幅让步。
V4-Flash在推理、编程和智能体任务等基准测试中与Claude Opus 4.8表现持平,而运行成本低约99%。这一效率主要归功于DeepSeek采用的混合专家(MoE)架构,该设计使得任何给定任务只激活模型参数的一部分。
对于每天运行数千次AI推理调用的企业来说,仅需更换服务商就能让算力账单降低数个数量级。每次输出0.28美元对25至30美元,这笔账不用算盘也能算清楚。
基准之外的深层意义。关于蒸馏攻击的报道(即某实验室的模型输出被用来训练竞争对手的系统)加剧了DeepSeek与西方AI公司之间的紧张关系。与OpenAI和Anthropic的API兼容性意味着,对于正在评估替代方案的开发者来说,切换成本相对较低。
免责声明:本文提供的信息不是交易建议。BlockWeeks.com不对根据本文提供的信息所做的任何投资承担责任。我们强烈建议在做出任何投资决策之前进行独立研究或咨询合格的专业人士。