返回行业动态
模型与产品

DeepSeek V3.1 正式发布:混合推理架构,Agent 能力大幅增强

DeepSeek 正式发布 V3.1 模型,采用「思考/非思考」模式自由切换的混合推理架构,在 V3 基础上新增 8400 亿 tokens 训练,支持 Anthropic API 格式,权重已在 Hugging Face 与魔搭开源。官方称 V3.1-Think 在输出 token 减少 20%-50% 时表现与 R1-0528 持平。

来源:DeepSeek 官方原标题:DeepSeek V3.1 发布公告查看原文
深海鲸鱼与数据流结合的AI模型插画

图片来源:DeepSeek

发生了什么

DeepSeek 于 8 月 21 日正式发布 V3.1 模型,采用「思考/非思考」模式自由切换的混合推理架构。该模型在 V3 基础之上新增 8400 亿 tokens 训练,支持 Anthropic API 格式,权重已在 Hugging Face 与魔搭开源。

官方数据显示,V3.1-Think 在输出 token 减少 20% 至 50% 的情况下,表现与 R1-0528 持平,意味着在保持推理质量的同时显著降低了推理成本与延迟。API 定价方面,自 9 月 6 日起取消夜间优惠,输出价格由 8 元涨至 12 元每百万 tokens。

  • 混合推理架构支持用户按任务复杂度自由切换思考模式
  • 兼容 Anthropic API 格式,降低迁移成本
  • 开源权重覆盖 Hugging Face 与魔搭两大平台

为什么重要

DeepSeek 系列一直以高性价比著称,V3.1 的混合推理设计进一步强化了 Agent 场景下的成本效率。对企业开发者而言,在简单任务上关闭思考模式、在复杂任务上启用思考模式,可以在不牺牲质量的前提下显著压缩推理开支。

同时,V3.1 对 Anthropic API 格式的支持降低了企业从闭源模型迁移的门槛,配合开源权重,为私有化部署提供了更灵活的选择。

仍待观察

涨价后的 API 定价是否影响其性价比优势,以及混合推理模式在实际 Agent 工作流中的稳定表现,需要开发者实际验证。开源社区的基准复现结果将是重要参考。

编辑说明

本文由北京拓实科技根据公开信息整理,核心事实与数据请以原始来源为准。

DeepSeek V3.1 正式发布:混合推理架构 Agent 能力增强|北京拓实科技