DeepSeek-V3.1有哪些升级亮点,UE8M0FP8又有何特别之处?

DeepSeek-V3.1的发布与背景
发布时机与版本定位
8月21日,在业界对R2模型满怀期待之时,DeepSeek官方推出了新模型V3.1。从版本命名来看,它似乎并非重大的版本更新,更倾向于是前一代DeepSeek-V3模型的小版本迭代。这并不意味着它的升级内容不值得关注,相反,此次发布为模型的发展带来了新的方向。
官方对新模型的定位
在X平台上,DeepSeek将V3.1称作“我们迈向智能体时代的第一步”。这一定位显示出官方对该模型的厚望,意味着它在智能体相关能力的发展上有着重要意义,是朝着智能体时代迈进的关键一步。
DeepSeek-V3.1的升级亮点
更强的Agent能力
通过后训练优化,新模型在工具使用与智能体任务中的表现大幅提升。在编程智能体、搜索智能体测评里,V3.1相较于之前的DeepSeek系列模型进步显著。这一提升使得模型在实际应用中能够更好地完成各种复杂任务,为用户带来更优质的服务。

混合思考模式
DeepSeek-V3.1采用混合推理架构,一个模型同时支持思考模式和非思考模式。用户在官方App与网页端能通过“深度思考”按钮,自由切换这两种模式。这种独特的设计让模型可以根据不同任务需求灵活调整,避免在简单任务上浪费时间,同时在复杂任务中进行全面分析。
更高的思考效率
官方表示,DeepSeek-V3.1-Think在保持与DeepSeek-R1-0528相当答案质量的情况下,响应速度更快。经过思维链压缩训练后,V3.1-Think输出token数减少20%-50%,但各项任务平均表现与R1-0528持平。在非思考模式下,输出长度也得到有效控制,性能依旧保持良好。
DeepSeek-V3.1的其他变化
参数精度与芯片关联
DeepSeek-V3.1使用了UE8M0FP8Scale的参数精度,并且DeepSeek官微置顶留言称,UE8M0FP8是针对即将发布的下一代国产芯片设计。这显示出模型在技术底层的布局,与国产芯片的发展有着紧密联系,有望在未来借助国产芯片的优势实现更好的性能表现。
价格调整
自9月6日凌晨起,DeepSeek对模型的API接口调用价格进行了调整。取消夜间时段优惠,输入价格缓存命中时为0.5元/百万tokens,缓存未命中为4元/百万tokens,输出价格为12元/百万tokens。此次价格调整反映了模型在运营和成本方面的一些变化。
开源与API支持扩展
V3.1的基础模型与后训练模型均在Huggingface与魔搭开源,促进了技术的交流与共享。DeepSeek宣布增加对海外模型AnthropicAPI格式的支持,用户可将DeepSeek-V3.1的能力接入ClaudeCode框架,进一步拓展了模型的应用范围。

相关问答
DeepSeek-V1是什么时候发布的?
1,虽然从命名看像是小版本迭代,但带来了诸多升级亮点。
DeepSeek-V1有哪些升级亮点?
有更强的Agent能力,在智能体任务中表现提升;采用混合思考模式,可自由切换模式;思考效率更高,响应速度加快且输出控制良好。
UE8M0FP8有什么特别之处?
UE1,体现了模型与国产芯片的技术关联。
DeepSeek-V1的价格有什么变化?
自9月6日凌晨起,取消夜间时段优惠,输入价格缓存命中和未命中情况有调整,输出价格也有所上涨。
DeepSeek-V1在开源方面有什么举措?
V1的基础模型与后训练模型均已在Huggingface与魔搭开源,促进了技术交流与共享。
DeepSeek-V1对API支持有什么扩展?
增加了对海外模型AnthropicAPI格式的支持,用户能够将其能力接入ClaudeCode框架,拓展应用范围。

