8月21日,DeepSeek在其官宣发布DeepSeek-V3.1的文章中提到,DeepSeek-V3.1使用了UE8M0 FP8 Scale的参数精度。另外 ,V3.1对分词器及chat template进行了较大调整,与DeepSeek-V3存在明显差异 。DeepSeek官微在置顶留言里表示,UE8M0 FP8是针对即将发布的下一代国产芯片设计。
相关报道DeepSeek发布新模型V3.1 价格涨了但Agent能力提升了
8月21日 ,业界千呼万唤的R2模型没来,但DeepSeek官方正式发布了新模型V3.1。从命名来看这或许不是一次大的版本更新,更像是前一代DeepSeek-V3模型的小版本迭代 。
在X上 ,DeepSeek将V3.1称为“我们迈向智能体时代的第一步”(our first step toward the agent era)。本次升级主要有三大亮点,其中包括更强的 Agent能力、混合思考模式和更高的思考效率。
官方表示,通过后训练优化 ,新模型在工具使用与智能体任务中的表现有较大提升 。在编程智能体、搜索智能体测评中, V3.1 相比之前的 DeepSeek 系列模型都有明显提高。
DeepSeek-V3.1 是混合推理架构,一个模型同时支持思考模式和非思考模式。目前用户可在官方 App与网页端体验新模型 ,通过“深度思考 ”按钮,实现思考模式与非思考模式的自由切换 。DeepSeek API 也已同步升级,deepseek-chat对应非思考模式,deepseek-reasoner对应思考模式 ,且上下文均已扩展为 128K。
“混合推理非常棒。拥有一个能够在深度思考和快速响应之间切换的模型,感觉就像是实用人工智能的未来 。”X上有网友表示,“在深度推理和快速反应之间切换真是天才之举。”根据查询调整深度 ,可以避免在简单任务上过度耗时,同时在需要时进行全面分析。
与之前的版本相比,V3.1也有更高的思考效率。官方表示 ,DeepSeek-V3.1-Think 在保持与 DeepSeek-R1-0528 相当的答案质量的同时,响应速度更快 。
官方测试结果显示,经过思维链压缩训练后 ,V3.1-Think 在输出 token 数减少 20%-50% 的情况下,各项任务的平均表现与 R1-0528 持平。
同时,V3.1 在非思考模式下的输出长度也得到了有效控制 ,相比于 DeepSeek-V3-0324 ,能够在输出长度明显减少的情况下保持相同的模型性能。
同步地,DeepSeek进行了价格调整,模型的API接口调用价格有所上涨 。自 9 月 6 日凌晨起 ,取消夜间时段优惠,输入价格上,缓存命中时为0.5元/百万tokens ,缓存未命中的价格则为4元/百万tokens(此前V3为2元/百万tokens);输出价格为12元/百万tokens(此前V3为8元/百万tokens)。
官方提到,V3.1的基础模型在V3的基础上重新做了外扩训练,一共增加训练了840B tokens。基础模型与后训练模型均已在Huggingface与魔搭开源 。
值得一提的是 ,DeepSeek此次还宣布增加了对海外模型Anthropic API格式的支持,官方提到这是“为了满足大家对 Anthropic API 生态的使用需求 ”,用户可以将 DeepSeek-V3.1 的能力接入Claude Code框架。
股票开户网上流程:债券杠杆交易是什么意思-格栅板脱落坠入浮选槽 6名大学生在选矿厂不幸溺亡!溺亡者同学:里面是矿浆 人掉进去动不了
炒股中杠杆是什么意思:股票手机开户交易-秋季市场券商前瞻:科技主线与资金活水共舞
炒股如何用杠杆:股票倍投交易方法-事关AI芯片!阿里发声:支持国产为真 大规模采购寒武纪不实
炒股杠杆交易是什么意思:手机买卖股票怎么开户-存款“搬家”信号初现 “00后”股民入市:行情热起来 感觉到处都是机会
股市加杠杆是什么意思:配资股票论坛-“国家队”资金流向曝光 Q2增持个股名单一览
杠杆炒股平仓是什么意思:股票开户的券商正规的有哪些-关税调整下的国内锂电池生产商:从担心放假到被催着生产发货
广盛网app-低息配资开户平台|实现低利率并保持服务的高质量提示:文章来自网络,不代表本站观点。
广盛网app-低息配资开户平台|实现低利率并保持服务的高质量㉖合规的股票配资平台会加强对投资顾问的资质审核和持续培训,确保投资顾问具备专业的投资知识和经验。
界面新闻记者|李科文界面新闻编辑|谢欣2月18日,据港交所公告,真实生物已递表港交所主板。据招股书,中金...
特朗普宣布暂停“对等关税”90天,纳指隔夜暴涨超12%。今日(4月10日),A股三大指数集体高开,沪指涨1.29%,深证...
消息面上,4月9日消息,美国总统发表讲话称,美国将对药品征收关税。我国生物医药行业对美商品贸易以仿制药出口为主,国产创新...
中国商务部国际贸易谈判代表兼副部长李成钢10日晚在英国伦敦说,过去两天,中美双方团队进行了深入交流,就落实两国元首6...
7月15日有关部门召开钾肥保供稳价会议,骨干流通企业均认为近期钾肥价格异常上涨严重偏离基本面,后期将加强市场供应,推...
界面新闻记者|孙艺真3月21日晚间,沪深交易所发布《以上市公司质量为导向的保荐机构执业质量评价实施办法(试行...
近期美国所谓“对等关税”政策引发全球资产巨震,本周一科技板块调整尤为明显。为了稳定资本市场,汇金、央行等机构稳市打出组合...
记者|张乔遇半导体前道设备的国产化进程一直备受关注。截至2023年末,前道量检测设备的国内企业市场份额约...
记者王珍中国国际经济交流中心副理事长、国务院发展研究中心原副主任王一鸣周一在“中国发展高层论坛2025...
界面新闻记者|龙力开年两个多月,不少头部量化私募都在积极“上新”。Wind数据显示,截至3月17日,...
界面新闻记者|龙力近期,部分全天候策略私募产品净值出现了较为明显的回撤。Wind数据显示,名称中含有...
记者|赵阳戈年初,证监会就修改《证券发行与承销管理办法》部分条款向社会公开征求意见,市场也将注意力投向了...
2025年3月25日,倍轻松(688793.SH)公告称,公司股东宁波倍松投资有限公司(简称“宁波倍松”)拟通过大宗交易...
3月24日,海洋王照明科技股份有限公司(以下简称“海洋王”,002724.SZ)早盘一字跌停,此后股价拉涨,尾盘封涨停板...
2025年3月24日下午三点A股收盘后,港股科技板块持续走强至四点十分收盘。消息面上,一方面美元相对于人民币连续3个交易...