DeepSeek发布新模型V3.1,价格涨了但Agent能力提升了

"迈向智能体时代的第一步"。 8月21日,业界千呼万唤的R2模型没来,但DeepSeek官方正式发布了新模型V3.1。从命名来看这或许不是一次大的版本更新,更像是前一代DeepSeek-V3模 型的小版本迭代。 在X上,DeepSeek将V3.1称为"我们迈向智能体时代的第一步"(our first step toward the agent era)。本次升级主要有三大亮点,其中包括更强的 Agent能力、 混合思考模式和更高的思考效率。 官方表示,通过后训练优化,新模型在工具使用与智能体任务中的表现有较大提升。在编程智能体、搜索智能体测评中, V3.1 相比之前的 DeepSeek 系列 模型都有明显提高。 | Benchmarks | DeepSeek-V3.1 | | --- | --- | | SWE-bench | 66.0 | | Verified | | | SWE-bench | 54.5 | | Multilingual | | | Terminal-Bench | 31.3 | DeepSeek-V3.1 是混合推理架构,一个模型同时支持思考模式和非思考模式。目前用户可在官方 App与网 ...