8月21日,DeepSeek在其官宣发布DeepSeek-V3.1的文章中提到,DeepSeek-V3.1使用了UE8M0 FP8 Scale的参数精度。另外 ,V3.1对分词器及chat template进行了较大调整,与DeepSeek-V3存在明显差异 。DeepSeek官微在置顶留言里表示,UE8M0 FP8是针对即将发布的下一代国产芯片设计。
相关报道DeepSeek发布新模型V3.1 价格涨了但Agent能力提升了
8月21日 ,业界千呼万唤的R2模型没来,但DeepSeek官方正式发布了新模型V3.1。从命名来看这或许不是一次大的版本更新,更像是前一代DeepSeek-V3模型的小版本迭代 。
在X上 ,DeepSeek将V3.1称为“我们迈向智能体时代的第一步”(our first step toward the agent era)。本次升级主要有三大亮点,其中包括更强的 Agent能力、混合思考模式和更高的思考效率。
官方表示,通过后训练优化 ,新模型在工具使用与智能体任务中的表现有较大提升 。在编程智能体、搜索智能体测评中, V3.1 相比之前的 DeepSeek 系列模型都有明显提高。
DeepSeek-V3.1 是混合推理架构,一个模型同时支持思考模式和非思考模式。目前用户可在官方 App与网页端体验新模型 ,通过“深度思考 ”按钮,实现思考模式与非思考模式的自由切换 。DeepSeek API 也已同步升级,deepseek-chat对应非思考模式,deepseek-reasoner对应思考模式 ,且上下文均已扩展为 128K。
“混合推理非常棒。拥有一个能够在深度思考和快速响应之间切换的模型,感觉就像是实用人工智能的未来 。”X上有网友表示,“在深度推理和快速反应之间切换真是天才之举。”根据查询调整深度 ,可以避免在简单任务上过度耗时,同时在需要时进行全面分析。
与之前的版本相比,V3.1也有更高的思考效率。官方表示 ,DeepSeek-V3.1-Think 在保持与 DeepSeek-R1-0528 相当的答案质量的同时,响应速度更快 。
官方测试结果显示,经过思维链压缩训练后 ,V3.1-Think 在输出 token 数减少 20%-50% 的情况下,各项任务的平均表现与 R1-0528 持平。
同时,V3.1 在非思考模式下的输出长度也得到了有效控制 ,相比于 DeepSeek-V3-0324 ,能够在输出长度明显减少的情况下保持相同的模型性能。
同步地,DeepSeek进行了价格调整,模型的API接口调用价格有所上涨 。自 9 月 6 日凌晨起 ,取消夜间时段优惠,输入价格上,缓存命中时为0.5元/百万tokens ,缓存未命中的价格则为4元/百万tokens(此前V3为2元/百万tokens);输出价格为12元/百万tokens(此前V3为8元/百万tokens)。
官方提到,V3.1的基础模型在V3的基础上重新做了外扩训练,一共增加训练了840B tokens。基础模型与后训练模型均已在Huggingface与魔搭开源 。
值得一提的是 ,DeepSeek此次还宣布增加了对海外模型Anthropic API格式的支持,官方提到这是“为了满足大家对 Anthropic API 生态的使用需求 ”,用户可以将 DeepSeek-V3.1 的能力接入Claude Code框架。
散户如何加杠杆买股票:日照股票配资-美国恢复对华发动机出口 波音飞机也已重启交付中国航司
散户怎么加杠杆:论坛股票配资-央行最新发布!5月开展7000亿元买断式逆回购 继续暂停国债买卖
散户如何给股票加杠杆:股票配资代码-全国政协召开2025年上半年宏观经济形势分析座谈会 王沪宁出席并讲话
股票网app:散户如何加杠杆买股票-我国科学家成功揭示固态电池短路机制
股票如何加杠杆:杭州股票配资-IEA:2025年全球原油供应预计将大幅超过需求增长
靠谱的股票推荐平台推荐:股票杠杆平台哪个好用-12家券商发布6月金股 排名靠前的公司名单来了
广升网配资提示:文章来自网络,不代表本站观点。
盛康配资-盛康配资APP-中国期货配资公司-怎么配资买股票^我们以专业、诚信、高效为服务理念,致力于打造线上正规股票配资平台的标杆,并不断提升客户体验以赢得更多客户的信赖。我们位列十大配资平台前列,与多家券商建立深度合作关系,实现资金的专款专用与高效流转。我们注重客户体验的持续性改进,通过收集客户反馈、分析市场趋势等方式,不断优化服务流程和产品功能。我们坚持实盘交易,注重风险控制的每一个环节,确保您的资金安全无忧。在线客服团队随时为您提供专业的投资解答和个性化的投资建议,让您的投资之路更加顺畅和成功。
文丨财联社国联资管和华安资管双双获批的消息再成市场关注点,券商资管子扩容加速,且待批者加快筹谋。截至目前...
宏观要闻市场监管总局发布《公平竞争审查条例实施办法》市场监管总局发布《公平竞争审查条例实施办法》,将于4...
2025年3月7日,三达膜(688101.SH)公告称,公司因与蓝晓科技的合同纠纷被诉至法院,要求支付5861.15万元...
界面新闻记者|龙力3月4日,尽管A股三大指数涨跌不一,但是全市场却有4000多只个股成功收涨,其中涨幅超过9...
据中国新闻社援引参考消息报道,6月18日稍早前,伊朗最高领袖哈梅内伊在社交平台X上发文,宣布伊朗与以色列冲突进入新阶...