DeepSeek-V3.1正式发布,上下文均扩展为128K

美羊羊1天前教育资讯3

8月21日,业界千呼万唤的R2模型没来,但DeepSeek官方正式发布了新模型V3.1。从命名来看这或许不是一次大的版本更新,更像是前一代DeepSeek-V3模型的小版本迭代。

在X上,DeepSeek将V3.1称为“我们迈向智能体时代的第一步”(our first step toward the agent era)。本次升级主要有三大亮点,其中包括更强的Agent能力、混合思考模式和更高的思考效率。

官方表示,通过后训练优化,新模型在工具使用与智能体任务中的表现有较大提升。在编程智能体、搜索智能体测评中, V3.1相比之前的DeepSeek系列模型都有明显提高。

诺基亚3.1发布时间__adobe扩展插件发布平台

DeepSeek-V3.1是混合推理架构,一个模型同时支持思考模式和非思考模式。目前用户可在官方App与网页端体验新模型,通过“深度思考”按钮,实现思考模式与非思考模式的自由切换。DeepSeek API也已同步升级,deepseek-chat对应非思考模式,deepseek-reasoner对应思考模式,且上下文均已扩展为128K。

“混合推理非常棒。拥有一个能够在深度思考和快速响应之间切换的模型,感觉就像是实用人工智能的未来。”X上有网友表示,“在深度推理和快速反应之间切换真是天才之举。”根据查询调整深度,可以避免在简单任务上过度耗时,同时在需要时进行全面分析。

与之前的版本相比,V3.1也有更高的思考效率。官方表示,DeepSeek-V3.1-Think在保持与 DeepSeek-R1-0528相当的答案质量的同时,响应速度更快。

官方测试结果显示,经过思维链压缩训练后,V3.1-Think 在输出 token 数减少20%-50% 的情况下,各项任务的平均表现与 R1-0528持平。

_诺基亚3.1发布时间_adobe扩展插件发布平台

在各项评测指标得分基本持平的情况下,R1-0528与 V3.1-Think 的 token 消耗量对比图

同时,V3.1在非思考模式下的输出长度也得到了有效控制,相比于 DeepSeek-V3-0324 ,能够在输出长度明显减少的情况下保持相同的模型性能。

同步地,DeepSeek进行了价格调整,模型的API接口调用价格有所上涨。自9月6日凌晨起,取消夜间时段优惠,输入价格上,缓存命中时为0.5元/百万tokens,缓存未命中的价格则为4元/百万tokens(此前V3为2元/百万tokens);输出价格为12元/百万tokens(此前V3为8元/百万tokens)。

诺基亚3.1发布时间_adobe扩展插件发布平台_

官方提到,V3.1的基础模型在V3的基础上重新做了外扩训练,一共增加训练了840B tokens。基础模型与后训练模型均已在Huggingface与魔搭开源。

值得一提的是,DeepSeek此次还宣布增加了对海外模型Anthropic API格式的支持,官方提到这是“为了满足大家对 Anthoripic API 生态的使用需求”,用户可以将 DeepSeek-V3.1的能力接入Claude Code框架。

相关文章

上戏新空间变身契诃夫笔下庄园,沉浸式《万尼亚舅舅》上演

上戏新空间变身契诃夫笔下庄园,沉浸式《万尼亚舅舅》上演

上海戏剧学院华山路校区的新空间,这几天成为了契诃夫笔下被时光遗忘的乡间庄园。观众行走在其中,感受俄罗斯戏剧的氛围。 6月18日-23日,上海戏剧学院2022级表演系舞美系实习大戏《万尼亚舅舅》以沉浸式...

从国民闺女到全网封杀!过亿身家蒸发背后,赵薇到底犯了啥事

从国民闺女到全网封杀!过亿身家蒸发背后,赵薇到底犯了啥事

2025年4月,赵薇因未偿还1.4万元债务被法院列为失信人。 十年前她坐拥57亿身家,名下法国酒庄、北京7套豪宅熠熠生辉。 从《还珠格格》里万人追捧的“小燕子”,到如今作品下架、婚姻破裂、负债累累的“...

4天3赛!北青:国足U18将参加中日韩青少年运动会男足项目比赛

4天3赛!北青:国足U18将参加中日韩青少年运动会男足项目比赛

直播吧8月21日讯 据《北京青年报》记者肖赧报道,国足U18将参加中日韩青少年运动会男足项目比赛,久尔杰维奇出任主教练。 在香河国家队训练基地进行为期4天的短训后,2007/2008年龄段中国U18...

9万元买的汗血宝马,高速追尾事故中受伤死亡!主人:货拉拉刚跑出约100公里就出事了

9万元买的汗血宝马,高速追尾事故中受伤死亡!主人:货拉拉刚跑出约100公里就出事了

游客被马踢中睾丸飞出2米 当事人:可能当不了爸爸了 近日,游客盛先生在网上发帖称,他在吉林省白山市长白山池西马场准备骑马时,突然被马踢到腹股沟,医院诊断显示其尾骨骨折、睾丸疼痛等。7月28日,马场工作...

乐游多彩贵州 踏歌爽爽贵阳 2025年“5·19中国旅游日”倒计时城市(贵阳)活动举办

乐游多彩贵州 踏歌爽爽贵阳 2025年“5·19中国旅游日”倒计时城市(贵阳)活动举办

5月18日,在2025年“5·19中国旅游日”城市(贵阳)活动现场,贵阳聚焦“文旅+娱乐”,以“民族团结”为纽带,携手各市州组成26个方阵近3600人的巡游队伍,沿中华路、遵义路行进开展贵州民族团结大...

2030年才能建成的新加坡“滨海湾金沙2.0版”,有什么看点?

2030年才能建成的新加坡“滨海湾金沙2.0版”,有什么看点?

01 楔子 这两天,我看到上海有些房产自媒体在提“ 滨海湾金沙新发展”这个项目(如上图),原因是上海北外滩最近土拍的地块,未来售价也将突破“20万+”,所以就有人拿上海和新加坡对标了。(下图为北外滩...

发表评论    

◎欢迎参与讨论,请在这里发表您的看法、交流您的观点。
客服微信:hnyanshan点击复制并跳转微信