当前位置:首页 > Deepseek最新资讯 > 正文内容

国泰海通:DeepSeek~V3.1加强智能体支持 与国产AI芯片协同创新

10个月前 (08-27)Deepseek最新资讯357

  发布研报称,DeepSeek V3.1在多项指标上性能大幅领先R1-0528,加强了智能体支持,独创性使用UE8M0 FP8 Scale精度,与国产AI芯片协同创新。DeepSeek-V3.1加强了智能体支持,并且针对下一代国产AI芯片设计;该行维持计算机板块“增持”评级。

  ①混合推理架构,一个模型同时支持思考模式和非思考模式,官方App与网页端模型已同步升级为DeepSeek-V3.1,用户可以通过“深度思考”按钮,实现思考模式和非思考模式自由切换;②更高的思考效率,相比DeepSeek-R1-0528deepseek,DeepSeek-V3.1-Think能在更短时间内给出答案;③更强的Agent能力,通过Post-Training优化,新模型在工具使用与智能体任务中的表现有较大提升。

  ①编程智能体,在代码修复测评SWE与命令行终端环境下的复杂任务(Terminal-Bench)测试中,DeepSeek-V3.1相比之前的DeepSeek系列模型有明显提高。②搜索智能体,DeepSeek-V3.1在多项搜索评测指标上取得了较大提升。在需要多步推理的复杂搜索测试(browsecomp)与多学科专家级难题测试(HLE)上,DeepSeek-V3.1性能已大幅领先R1-0528。③思考效率提升,测试结果显示,经过思维链压缩训练后,V3.1-Think在输出token数减少20%-50%的情况下,各项任务的平均表现与R1-0528持平。同时,V3.1在非思考模式下的输出长度也得到了有效控制,相比于DeepSeek-V3-0324,能够在输出长度明显减少的情况下保持相同的模型性能。

  ①V3.1的Base模型在V3的基础上重新做了外扩训练,一共增加训练了840Btokens。Base模型与后训练模型均已在Hugging face与魔搭开源。②需要注意的是,DeepSeek-V3.1使用了UE8M0 FP8 Scale的参数精度,UE8M0 FP8是针对即将发布的下一代国产芯片设计。③另外,V3.1对分词器及chat template进行了较大调整,与DeepSeek-V3存在明显差异。

  /特朗普:已有人选接替库克,鲍威尔也很快就离开了!美联储首次回应, 库克的律师宣布将起诉......

  /这次没有空中爆炸!1个小时飞越半个地球,马斯克星舰终于成功了,现场欢呼声、鼓掌声响成一片

  /苹果发布会前瞻:iPhone 17—“史上最薄iPhone”,以及苹果硬件发布会的其他预期新品

  /中国石油拟400亿元人民币收购储气库企业:德国汽车欧宝放弃先前电动化战略,延长燃油车型供应时间原文出处:国泰海通:DeepSeek~V3.1加强智能体支持 与国产AI芯片协同创新,感谢原作者,侵权必删!

标签: deepseek

“国泰海通:DeepSeek~V3.1加强智能体支持 与国产AI芯片协同创新” 的相关文章

12月15日DeepSeek预测:奇才vs步行者,西亚卡姆率队延续连胜?

12月15日DeepSeek预测:奇才vs步行者,西亚卡姆率队延续连胜?

  北京时间12月15日凌晨4点,NBA常规赛将上演一场东部垫底球队的较量——华盛顿奇才(3胜20负)客场挑战印第安纳步行者(6胜19负)。两支球队分别位列东部第15和第14,本赛季胜率均...

12月24日DeepSeek预测:雷霆vs马刺,西部巅峰对决,亚历山大能否带队复

12月24日DeepSeek预测:雷霆vs马刺,西部巅峰对决,亚历山大能否带队复

  圣诞大战前夕,西部榜首雷霆(26胜3负)将客场挑战老牌劲旅马刺(21胜7负),这场堪称西部决赛预演的较量因10天前马刺111-109险胜雷霆更添火药味。两支进攻效率联盟前六的球队相遇,...

使用量激增致算力不足,Kimi建议网友先用DeepSeek

使用量激增致算力不足,Kimi建议网友先用DeepSeek

  近日,知名大模型聚合平台OpenRouter数据显示,从上个月Kimi发布并开源Kimi K2.5模型以来,模型在总榜及多个分榜持续排名第一。近期由于使用量激增,有用户反映遇到Kimi...

12月3日DeepSeek预测:开拓者vs猛龙,猛龙主场复仇?阿夫迪亚对决英格拉

12月3日DeepSeek预测:开拓者vs猛龙,猛龙主场复仇?阿夫迪亚对决英格拉

  北京时间12月3日早8:30,NBA常规赛将迎来一场东西部对决,多伦多猛龙坐镇主场迎战波特兰开拓者。目前猛龙以14胜7负排名东部第4,而开拓者8胜12负位列西部第10。本文将为您带来全...

券商策略聚焦AI主线,混合式AI龙头配置价值凸显

券商策略聚焦AI主线,混合式AI龙头配置价值凸显

  近日,国金证券发布研报称,市场主线仍将聚焦于AI产业链,相比前两年,今年上半年AI技术在落地应用方面取得显著进展,预计下半年相关增长势头将进一步加速,实现环比倍数提升。报告明确指出了几...

DeepSeek-V3.2-Exp第一时间上线华为云

DeepSeek-V3.2-Exp第一时间上线华为云

  2025年9月29日,DeepSeek-V3.2-Exp模型正式发布并开源。模型引入稀疏 Attention 架构,这种架构能够有效降低计算资源消耗并提升模型推理效率。华为云第一时间完...