发生了什么
DeepSeek 于 8 月 21 日正式发布 V3.1 模型,采用「思考/非思考」模式自由切换的混合推理架构。该模型在 V3 基础之上新增 8400 亿 tokens 训练,支持 Anthropic API 格式,权重已在 Hugging Face 与魔搭开源。
官方数据显示,V3.1-Think 在输出 token 减少 20% 至 50% 的情况下,表现与 R1-0528 持平,意味着在保持推理质量的同时显著降低了推理成本与延迟。API 定价方面,自 9 月 6 日起取消夜间优惠,输出价格由 8 元涨至 12 元每百万 tokens。
- 混合推理架构支持用户按任务复杂度自由切换思考模式
- 兼容 Anthropic API 格式,降低迁移成本
- 开源权重覆盖 Hugging Face 与魔搭两大平台
为什么重要
DeepSeek 系列一直以高性价比著称,V3.1 的混合推理设计进一步强化了 Agent 场景下的成本效率。对企业开发者而言,在简单任务上关闭思考模式、在复杂任务上启用思考模式,可以在不牺牲质量的前提下显著压缩推理开支。
同时,V3.1 对 Anthropic API 格式的支持降低了企业从闭源模型迁移的门槛,配合开源权重,为私有化部署提供了更灵活的选择。
仍待观察
涨价后的 API 定价是否影响其性价比优势,以及混合推理模式在实际 Agent 工作流中的稳定表现,需要开发者实际验证。开源社区的基准复现结果将是重要参考。

