8月21日,DeepSeek在其官宣发布DeepSeek-V3.1的文章中提到 ,DeepSeek-V3.1使用了UE8M0 FP8 Scale的参数精度 。另外,V3.1对分词器及chat template进行了较大调整,与DeepSeek-V3存在明显差异。DeepSeek官微在置顶留言里表示,UE8M0 FP8是针对即将发布的下一代国产芯片设计。
相关报道DeepSeek发布新模型V3.1 价格涨了但Agent能力提升了
8月21日 ,业界千呼万唤的R2模型没来,但DeepSeek官方正式发布了新模型V3.1。从命名来看这或许不是一次大的版本更新,更像是前一代DeepSeek-V3模型的小版本迭代 。
在X上 ,DeepSeek将V3.1称为“我们迈向智能体时代的第一步 ”(our first step toward the agent era)。本次升级主要有三大亮点,其中包括更强的 Agent能力、混合思考模式和更高的思考效率。
官方表示,通过后训练优化 ,新模型在工具使用与智能体任务中的表现有较大提升 。在编程智能体 、搜索智能体测评中, V3.1 相比之前的 DeepSeek 系列模型都有明显提高。
DeepSeek-V3.1 是混合推理架构,一个模型同时支持思考模式和非思考模式。目前用户可在官方 App与网页端体验新模型 ,通过“深度思考”按钮,实现思考模式与非思考模式的自由切换 。DeepSeek API 也已同步升级,deepseek-chat对应非思考模式 ,deepseek-reasoner对应思考模式,且上下文均已扩展为 128K。
“混合推理非常棒。拥有一个能够在深度思考和快速响应之间切换的模型,感觉就像是实用人工智能的未来 。”X上有网友表示,“在深度推理和快速反应之间切换真是天才之举。”根据查询调整深度 ,可以避免在简单任务上过度耗时,同时在需要时进行全面分析。
与之前的版本相比,V3.1也有更高的思考效率 。官方表示 ,DeepSeek-V3.1-Think 在保持与 DeepSeek-R1-0528 相当的答案质量的同时,响应速度更快。
官方测试结果显示,经过思维链压缩训练后 ,V3.1-Think 在输出 token 数减少 20%-50% 的情况下,各项任务的平均表现与 R1-0528 持平。
同时,V3.1 在非思考模式下的输出长度也得到了有效控制 ,相比于 DeepSeek-V3-0324 ,能够在输出长度明显减少的情况下保持相同的模型性能。
同步地,DeepSeek进行了价格调整 ,模型的API接口调用价格有所上涨 。自 9 月 6 日凌晨起,取消夜间时段优惠,输入价格上,缓存命中时为0.5元/百万tokens ,缓存未命中的价格则为4元/百万tokens(此前V3为2元/百万tokens);输出价格为12元/百万tokens(此前V3为8元/百万tokens)。
官方提到,V3.1的基础模型在V3的基础上重新做了外扩训练,一共增加训练了840B tokens。基础模型与后训练模型均已在Huggingface与魔搭开源 。
值得一提的是 ,DeepSeek此次还宣布增加了对海外模型Anthropic API格式的支持,官方提到这是“为了满足大家对 Anthoripic API 生态的使用需求 ”,用户可以将 DeepSeek-V3.1 的能力接入Claude Code框架。
股票比较好的平台:炒股创业板股票开户流程-欧盟推迟对美国征收报复性关税 内部质疑声音浮现
网上开户股票开户流程:炒股配资评测网-科创板开市六周年 65家券商分羹IPO 国泰海通、中信、中金保荐项目居前
怎么买股票开户要多少钱:配资炒股开户技巧-AI推理芯片爆发 谁将是下一个寒武纪?
配资网了解网上炒股公司:股票配资开户介简配资出色-IPO周报|1.05亿股!2024年至今发行数最多的创业板新股来了
网上配资炒股门户:股票怎么在手机怎么开户流程-瞄准机器人“推理大脑”!英伟达推出具身智能推理模型Cosmos Reason
股票炒股股票开户流程:免息配资炒股-经济日报:“人工智能+”会取代“互联网+”吗?
翔云优配-翔云优配平台-配资官方网站提示:文章来自网络,不代表本站观点。
翔云优配-翔云优配平台-配资官方网站㉖股票配资平台以科技为引领,利用大数据、人工智能等技术手段,提升服务效率和精准度。
界面新闻记者|龙力去年全年112只,今年3个月不到就新发76只,上海宽德私募近一年多以来的“上新”频率震惊了...
界面新闻记者|何柳颖界面新闻编辑|王姝...
近期,前沿生物艾可宁®长效抗病毒方案迎来新突破。国际权威期刊《AIDS》官网刊登了一篇艾可宁®每4周给药的长效ART方案...
中国驻赞比亚大使馆6月27日发布关于“3·20”中国同胞遇害案件侦破进展的通报: 日前,赞比亚铜带省警察厅向中国驻...
3月20日-21日,由中国零售(餐饮)CIO俱乐部与《智慧零售与餐饮》新媒体联合主办的“2025第十一届智慧商业数字化运...
美股三大指数集体收涨,纳斯达克指数涨2.06%,标普500指数涨1.81%,道琼斯指数涨1.56%。标普500指数本周上...
3月24日,香雪制药(300147.SZ)公告称,公司及相关当事人收到中国证监会广东监管局的《行政处罚事先告知书》。香雪...
记者辛圆中国人民银行授权全国银行间同业拆借中心公布,3月20日贷款市场报价利率(LPR)为:1年期LP...
北京时间周五凌晨,美国科技公司OpenAI临时举行直播活动,发布通用人工智能代理ChatGPT智能体。 简单描述,...
近期全球金融市场波动加剧,A股市场主线不明朗,投资者风险偏好持续收敛。在此背景下,现金流ETF800(认购代码:5164...
记者王珍中国国际经济交流中心副理事长、国务院发展研究中心原副主任王一鸣周一在“中国发展高层论坛2025...
记者辛圆3月25日,博鳌亚洲论坛旗舰报告《亚洲经济前景及一体化进程2025年度报告》(以下简称《报告》...
记者|赵阳戈年初,证监会就修改《证券发行与承销管理办法》部分条款向社会公开征求意见,市场也将注意力投向了...
3月24日,易方达国证自由现金流ETF公开发售。该产品跟踪国证自由现金流指数,这个指数是什么?有哪些优势?投资价值如何?...
2025年3月25日,倍轻松(688793.SH)公告称,公司股东宁波倍松投资有限公司(简称“宁波倍松”)拟通过大宗交易...