8月21日,DeepSeek在其官宣发布DeepSeek-V3.1的文章中提到 ,DeepSeek-V3.1使用了UE8M0 FP8 Scale的参数精度 。另外,V3.1对分词器及chat template进行了较大调整,与DeepSeek-V3存在明显差异。DeepSeek官微在置顶留言里表示,UE8M0 FP8是针对即将发布的下一代国产芯片设计。
相关报道DeepSeek发布新模型V3.1 价格涨了但Agent能力提升了
8月21日 ,业界千呼万唤的R2模型没来,但DeepSeek官方正式发布了新模型V3.1。从命名来看这或许不是一次大的版本更新,更像是前一代DeepSeek-V3模型的小版本迭代 。
在X上 ,DeepSeek将V3.1称为“我们迈向智能体时代的第一步 ”(our first step toward the agent era)。本次升级主要有三大亮点,其中包括更强的 Agent能力、混合思考模式和更高的思考效率。
官方表示,通过后训练优化 ,新模型在工具使用与智能体任务中的表现有较大提升 。在编程智能体 、搜索智能体测评中, V3.1 相比之前的 DeepSeek 系列模型都有明显提高。
DeepSeek-V3.1 是混合推理架构,一个模型同时支持思考模式和非思考模式。目前用户可在官方 App与网页端体验新模型 ,通过“深度思考”按钮,实现思考模式与非思考模式的自由切换 。DeepSeek API 也已同步升级,deepseek-chat对应非思考模式 ,deepseek-reasoner对应思考模式,且上下文均已扩展为 128K。
“混合推理非常棒。拥有一个能够在深度思考和快速响应之间切换的模型,感觉就像是实用人工智能的未来 。”X上有网友表示,“在深度推理和快速反应之间切换真是天才之举。”根据查询调整深度 ,可以避免在简单任务上过度耗时,同时在需要时进行全面分析。
与之前的版本相比,V3.1也有更高的思考效率 。官方表示 ,DeepSeek-V3.1-Think 在保持与 DeepSeek-R1-0528 相当的答案质量的同时,响应速度更快。
官方测试结果显示,经过思维链压缩训练后 ,V3.1-Think 在输出 token 数减少 20%-50% 的情况下,各项任务的平均表现与 R1-0528 持平。
同时,V3.1 在非思考模式下的输出长度也得到了有效控制 ,相比于 DeepSeek-V3-0324 ,能够在输出长度明显减少的情况下保持相同的模型性能。
同步地,DeepSeek进行了价格调整 ,模型的API接口调用价格有所上涨 。自 9 月 6 日凌晨起,取消夜间时段优惠,输入价格上,缓存命中时为0.5元/百万tokens ,缓存未命中的价格则为4元/百万tokens(此前V3为2元/百万tokens);输出价格为12元/百万tokens(此前V3为8元/百万tokens)。
官方提到,V3.1的基础模型在V3的基础上重新做了外扩训练,一共增加训练了840B tokens。基础模型与后训练模型均已在Huggingface与魔搭开源 。
值得一提的是 ,DeepSeek此次还宣布增加了对海外模型Anthropic API格式的支持,官方提到这是“为了满足大家对 Anthoripic API 生态的使用需求 ”,用户可以将 DeepSeek-V3.1 的能力接入Claude Code框架。
炒股票的手机:北京配资网-国产芯片再迎利好!智谱发布新一代大模型 全面适配寒武纪和摩尔线程芯片!
手机炒股怎么加杠杆:股票散户怎么办-科创板芯片设计板块三季报盘点:59家营收实现正增长 10家扭亏为盈
股票杠杆交易怎么开通:靠谱股票配资-反倾销点燃A股模拟芯片赛道 机构:国产厂商份额有望提升
刚开户可以买哪些股票:买300股票的开户条件-国产AI软硬协同加速:DeepSeek新模型上线 一众芯片厂商官宣Day 0适配
股票开户每个人可以开几个:手机股票软件排行榜-字节回应与中兴手机合作:无自研手机计划 发布手机助手技术预览版
股票加杠杆多少:股票杠杆开通的方法有几种-智谱发布首个手机智能体:一句话点外卖订机票 手表、眼镜、家电等均能接入
汇盈策略-汇盈策略官网-兰州股票配资公司提示:文章来自网络,不代表本站观点。
央行公告,为保持银行体系流动性充裕,更好满足不同参与机构差异化资金需求,自本月起中期借贷便利(MLF)将采用固定数量、利...
国家卫健委主任雷海潮在参加十四届全国人大三次会议江苏代表团开放团组会议时指出,人口问题仍是一个需要深入和动态研究的重要问...
...
...
华电新能在上交所正式上市,华润新能源上市稳步推进……一批新能源领域央企正加速挺进资本市场;国家电投、国家能源集团等企...
美股财报季危险重重。 美东时间8月1日,美股开盘后,美国电商巨头亚马逊股价重挫,盘中一度暴跌超9%。有分析称,最新...
7月26日,2025世界人工智能大会暨人工智能全球治理高级别会议发表《人工智能全球治理行动计划》。全文如下: 人工...
界面新闻记者|邹文榕近段时间,一款信托合同当中隐藏“受益人代表/委托人代表”条款的政信信托开始在江浙等区域流...
2025年4月12日,永安行(603776.SH)发布2024年年报。 公司营业总收入为4.5...
4月14日,国内商品期货早盘开盘,涨多跌少。NR、氧化铝等涨超2%,沪镍、沪锡等涨超1%,豆油、沪锌等小幅上涨;集运欧线...
记者辛圆中国工程机械工业协会最新公布统计数据显示,2025年1-3月,共销售挖掘机61372台,同比增...
记者今天从国家发展改革委了解到,近日,国家发展改革委、财政部、自然资源部、商务部、中国人民银行、税务总局、国家外汇局...
记者辛圆3月20日下午,商务部举行例行记者会,发言人何咏前回应了包括扩大对外开放、内外贸一体化以及中日...
下周解禁市值超270亿元。 下周解禁市值超270亿元 下周将有40余股面临解禁,按照最新收盘价计算,合计解禁市值...
关税风波一起,我国多部门便联合打出组合拳,力筑资本市场“防波堤”。“增持”“已再次增持”“未来将继续增持”“加快实施增持...