8月21日,大家翘首以盼的R2版本并未问世,DeepSeek机构却公开推出了新一代模型V3.1。根据名称推断,这次发布或许并非重大升级,而更像是DeepSeek-V3的前一个版本进行了小幅改动。
DeepSeek把V3.1称作“我们走向智能体时代的初始阶段”,这次版本更新有三个重要改进,分别是Agent功能得到增强,引入了融合式推理方法,以及思考过程变得更加高效。
官方透露,新模型在经过后续训练改进后,其运用工具及执行智能体任务的能力获得了显著增强。针对编程智能体与搜索智能体的评估结果显示,V3.1版本相较于先前的DeepSeek系列各项模型,均展现出更为突出的进步。
DeepSeek-V3.1 采用组合式运算方式,一个模型能够执行分析步骤和直接响应两种操作。现阶段用户可以在官方应用程序和网站版上试用这一新版本,借助“深度分析”选项,可以随时在分析步骤和直接响应之间转换。DeepSeek API 已经完成更新,deepseek-chat 功能对应非推理状态,deepseek-reasoner 功能对应推理状态,同时上下文长度均增加至 128K。
混合推理十分出色。配备一个能在深度思索和迅捷回应间转换的模型,仿佛就是实用型人工智能的远景。这种在深度分析和迅速应对之间转换的构思确实令人惊叹。通过查询来调整深度,能够防止在简单工作上面消耗过多时间,而且可以在必要时进行彻底研究。
V3.1版本在思考方面表现更佳。根据官方说明,DeepSeek-V3.1-Think 在维持与 DeepSeek-R1-0528 几乎相同的答案水准基础上,其回应时间有所提升。

官方测试数据表明,经过思维链压缩训练,V3.1-Think 在输出 token 数量降低 20% 到 50% 的情形下,各项任务的整体表现与 R1-0528 相当。
此外,V3.1 在非推理状态下的生成篇幅实现了有效压缩,与 DeepSeek-V3-0324 相比,即便显著缩短了输出篇幅,依然能够维持同等水平的模型表现。
同时,DeepSeek 实施了定价变更,其模型的API调用费用出现了增长。从 9 月 6 日凌晨开始,不再提供夜间时段的折扣优惠,价格设定上,如果查询结果能从缓存中获取,每百万 tokens 的费用是 0.5 元,而无法从缓存中获取的情况,每百万 tokens 的费用是 4 元(原先 V3 版本是 2 元每百万 tokens);对于输出内容,每百万 tokens 的价格是 12 元(之前 V3 版本是 8 元每百万 tokens)。
官方透露,V3.1的核心模型在V3版本上进行了额外的训练扩展,总共加入了840B个训练数据单元,基础模型和后续训练的模型都已经在Huggingface平台和魔搭上公开发布了。
值得注意的一点是,DeepSeek此次还公布扩展了对海外模型Anthropic API格式的兼容性,官方表示此举旨在“顺应大众对Anthropic API生态的应用需求”,用户现在能够将DeepSeek-V3.1的功能整合进Claude Code框架。


Copyright C 2025 All Rights Reserved 皖ICP备2024052706号-7
地址: EMAIL:1210524564@qq.com
Powered by PHPYun.