DeepSeek发布V3.1模型，引领AI新潮流

国内财经 2025-08-21 16:30:42 来源：第一财经作者：网络

AI导读：

8月21日，DeepSeek官方正式发布新模型V3.1，具备更强Agent能力、混合思考模式和更高思考效率。用户可在官方App与网页端体验，实现思考与非思考模式自由切换。同时，DeepSeek进行了价格调整，API接口调用价格有所上涨。

　　8月21日，业界期待已久的R2模型未现身，但Deepseek官方正式发布了新模型V3.1，这一智能模型升级或引领AI新潮流。从命名来看这或许不是一次大的版本更新，更像是前一代DeepSeek-V3模型的小版本迭代。

　　在X上，DeepSeek将V3.1称为“我们迈向智能体时代的第一步”（our first step toward the agent era）。本次智能升级主要有三大亮点，包括更强的Agent能力、混合思考模式和更高的思考效率，展现了AI技术的前沿进展。

　　官方表示，通过后训练优化，新模型在工具使用与智能体任务中的表现有较大提升。在编程智能体、搜索智能体测评中， V3.1 相比之前的 DeepSeek 系列模型都有明显提高。

　　DeepSeek-V3.1 是混合推理架构，一个模型同时支持思考模式和非思考模式。目前用户可在官方 App与网页端体验新模型，通过“深度思考”按钮，实现思考模式与非思考模式的自由切换。DeepSeek API 也已同步升级，deepseek-chat对应非思考模式，deepseek-reasoner对应思考模式，且上下文均已扩展为 128K，为用户提供更灵活的AI交互体验。

　　“混合推理非常棒。拥有一个能够在深度思考和快速响应之间切换的模型，感觉就像是实用人工智能的未来。”X上有网友表示，“在深度推理和快速反应之间切换真是天才之举。”根据查询调整深度，可以避免在简单任务上过度耗时，同时在需要时进行全面分析，体现了AI模型的智能化与高效性。

　　与之前的版本相比，V3.1也有更高的思考效率。官方表示，DeepSeek-V3.1-Think 在保持与 DeepSeek-R1-0528 相当的答案质量的同时，响应速度更快，展现了AI模型在性能上的显著提升。

　　官方测试结果显示，经过思维链压缩训练后，V3.1-Think 在输出 token 数减少 20%-50% 的情况下，各项任务的平均表现与 R1-0528 持平。

　　同时，V3.1 在非思考模式下的输出长度也得到了有效控制，相比于 DeepSeek-V3-0324 ，能够在输出长度明显减少的情况下保持相同的模型性能，进一步提升了AI模型的实用性。

　　同步地，DeepSeek进行了价格调整，模型的API接口调用价格有所上涨。自 9 月 6 日凌晨起，取消夜间时段优惠，输入价格上，缓存命中时为0.5元/百万tokens，缓存未命中的价格则为4元/百万tokens（此前V3为2元/百万tokens）；输出价格为12元/百万tokens（此前V3为8元/百万tokens）。

　　官方提到，V3.1的基础模型在V3的基础上重新做了外扩训练，一共增加训练了840B tokens。基础模型与后训练模型均已在Huggingface与魔搭开源，为AI开发者提供了更多资源。

　　值得一提的是，DeepSeek此次还宣布增加了对海外模型Anthropic API格式的支持，官方提到这是“为了满足大家对 Anthoripic API 生态的使用需求”，用户可以将 DeepSeek-V3.1 的能力接入Claude Code框架，拓展了AI模型的应用场景。

（文章来源：第一财经）

郑重声明：以上内容与本站立场无关。本站发布此内容的目的在于传播更多信息，本站对其观点、判断保持中立，不保证该内容（包括但不限于文字、数据及图表）全部或者部分内容的准确性、真实性、完整性、有效性、及时性、原创性等。相关内容不对各位读者构成任何投资建议，据此操作，风险自担。股市有风险，投资需谨慎。如对该内容存在异议，或发现违法及不良信息，请发送邮件至yxiu_cn@foxmail.com，我们将安排核实处理。