
8月21日,业界千呼万唤的R2模子没来,但DeepSeek官耿直式发布了新模子V3.1。从定名来看这能够不是一次大的版块更新开云体育(中国)官方网站,更像是前一代DeepSeek-V3模子的小版块迭代。
在X上,DeepSeek将V3.1称为“咱们迈向智能体时期的第一步”(our first step toward the agent era)。本次升级主要有三大亮点,其中包括更强的 Agent才气、搀杂想考模式和更高的想考后果。
官方暗示,通事后侦察优化,新模子在用具使用与智能体任务中的领路存较大升迁。在编程智能体、搜索智能体测评中, V3.1 比拟之前的 DeepSeek 系列模子王人有显著提高。

DeepSeek-V3.1 是搀杂推理架构,一个模子同期维持想考模式和非想考模式。现时用户可在官方 App与网页端体验新模子,通过“深度想考”按钮,已矣想考模式与非想考模式的目田切换。DeepSeek API 也已同步升级,deepseek-chat对应非想考模式,deepseek-reasoner对应想考模式,且落魄文均已扩张为 128K。
“搀杂推理相配棒。领有一个能够在深度想考和快速反馈之间切换的模子,嗅觉就像是实用东谈主工智能的往常。”X上有网友暗示,“在深度推理和快速反应之间切换确切天才之举。”凭证查询调节深度,不错幸免在简便任务上过度耗时,同期在需要时进行全面分析。
与之前的版块比拟,V3.1也有更高的想考后果。官方暗示,DeepSeek-V3.1-Think 在保捏与 DeepSeek-R1-0528 特别的谜底质地的同期,反馈速率更快。
官方测试末端透露,历程想维链压缩侦察后,V3.1-Think 在输出 token 数减少 20%-50% 的情况下,各项任务的平均领路与 R1-0528 捏平。

同期,V3.1 在非想考模式下的输出长度也得到了灵验截止,比拟于 DeepSeek-V3-0324 ,能够在输出长度显著减少的情况下保捏疏导的模子性能。
同时局,DeepSeek进行了价钱调节,模子的API接口调用价钱有所高涨。自 9 月 6 日凌晨起,取消夜间时段优惠,输入价钱上,缓存射中时为0.5元/百万tokens,缓存未射中的价钱则为4元/百万tokens(此前V3为2元/百万tokens);输出价钱为12元/百万tokens(此前V3为8元/百万tokens)。

官方提到,V3.1的基础模子在V3的基础上从头作念了外扩侦察,一共增多侦察了840B tokens。基础模子与后侦察模子均已在Huggingface与魔搭开源。
值得一提的是,DeepSeek这次还书记增多了对国外模子Anthropic API圭表的维持,官方提到这是“为了骄横全球对 Anthropic API 生态的使用需求”,用户不错将 DeepSeek-V3.1 的才气接入Claude Code框架。
举报 第一财经告白调和,请点击这里此执算作第一财经原创,文章权归第一财经悉数。未经第一财经籍面授权,不得以任何形态加以使用,包括转载、摘编、复制或设立镜像。第一财经保留根究侵权者法律背负的权益。如需获取授权请规划第一财经版权部:banquan@yicai.com 文章作家
刘晓洁
关系阅读
特斯拉牵手豆包大模子与DeepSeek,均通及其山引擎接入特斯拉牵手豆包大模子与DeepSeek,均通及其山引擎接入
122 08-22 14:39
DeepSeek线上模子版块升级落魄文长度拓展至128K。
51 08-19 21:12
WAIC不雅察|Agent替代打工东谈主还要多久?别问替不替代,先问能不可用。
7 157 07-30 13:42
超等诳骗爆发在即,何如买通东谈主工智能诳骗落地的终末一公里?买通数据到模子才气升迁的闭环,是AI大模子落地的关节。大数据侦察何如达到最低可行智能,骄横场景诳骗的需求,是行业当今需要贬责的问题。
105 07-28 16:40
OpenAI发布ChatGPT Agent:部分才气特出东谈主类,但作念电子表格仍不如东谈主类在评估模子裁剪真正场景电子表格才气的测试中开云体育(中国)官方网站,ChatGPT Agent的最高得分45.5%远低于东谈主类得分71.3%。
12 272 07-18 10:53 一财最热 点击关闭