当前位置:首页 > Deepseek最新资讯 > 正文内容

国泰海通:DeepSeek~V3.1加强智能体支持 与国产AI芯片协同创新

8个月前 (08-27)Deepseek最新资讯354

  发布研报称,DeepSeek V3.1在多项指标上性能大幅领先R1-0528,加强了智能体支持,独创性使用UE8M0 FP8 Scale精度,与国产AI芯片协同创新。DeepSeek-V3.1加强了智能体支持,并且针对下一代国产AI芯片设计;该行维持计算机板块“增持”评级。

  ①混合推理架构,一个模型同时支持思考模式和非思考模式,官方App与网页端模型已同步升级为DeepSeek-V3.1,用户可以通过“深度思考”按钮,实现思考模式和非思考模式自由切换;②更高的思考效率,相比DeepSeek-R1-0528deepseek,DeepSeek-V3.1-Think能在更短时间内给出答案;③更强的Agent能力,通过Post-Training优化,新模型在工具使用与智能体任务中的表现有较大提升。

  ①编程智能体,在代码修复测评SWE与命令行终端环境下的复杂任务(Terminal-Bench)测试中,DeepSeek-V3.1相比之前的DeepSeek系列模型有明显提高。②搜索智能体,DeepSeek-V3.1在多项搜索评测指标上取得了较大提升。在需要多步推理的复杂搜索测试(browsecomp)与多学科专家级难题测试(HLE)上,DeepSeek-V3.1性能已大幅领先R1-0528。③思考效率提升,测试结果显示,经过思维链压缩训练后,V3.1-Think在输出token数减少20%-50%的情况下,各项任务的平均表现与R1-0528持平。同时,V3.1在非思考模式下的输出长度也得到了有效控制,相比于DeepSeek-V3-0324,能够在输出长度明显减少的情况下保持相同的模型性能。

  ①V3.1的Base模型在V3的基础上重新做了外扩训练,一共增加训练了840Btokens。Base模型与后训练模型均已在Hugging face与魔搭开源。②需要注意的是,DeepSeek-V3.1使用了UE8M0 FP8 Scale的参数精度,UE8M0 FP8是针对即将发布的下一代国产芯片设计。③另外,V3.1对分词器及chat template进行了较大调整,与DeepSeek-V3存在明显差异。

  /特朗普:已有人选接替库克,鲍威尔也很快就离开了!美联储首次回应, 库克的律师宣布将起诉......

  /这次没有空中爆炸!1个小时飞越半个地球,马斯克星舰终于成功了,现场欢呼声、鼓掌声响成一片

  /苹果发布会前瞻:iPhone 17—“史上最薄iPhone”,以及苹果硬件发布会的其他预期新品

  /中国石油拟400亿元人民币收购储气库企业:德国汽车欧宝放弃先前电动化战略,延长燃油车型供应时间原文出处:国泰海通:DeepSeek~V3.1加强智能体支持 与国产AI芯片协同创新,感谢原作者,侵权必删!

标签: deepseek

“国泰海通:DeepSeek~V3.1加强智能体支持 与国产AI芯片协同创新” 的相关文章

微云全息(NASDAQ: HOLO)Deepseek LLM:推动开源语言模型迈

微云全息(NASDAQ: HOLO)Deepseek LLM:推动开源语言模型迈

  在当今科技领域,开源大型语言模型(LLM)的快速发展令人瞩目,然而,缩放法则的相关研究却提出了不同的结论。在此背景下,微云全息(NASDAQ: HOLO)深入钻研缩放定律,取得了独特的...

12月27日DeepSeek预测热火vs老鹰:特雷杨率队主场复仇,阿德巴约伤病成

12月27日DeepSeek预测热火vs老鹰:特雷杨率队主场复仇,阿德巴约伤病成

  北京时间12月27日早8点,NBA常规赛将迎来一场东部卡位战,迈阿密热火客场挑战亚特兰大老鹰。目前热火以15胜15负排名东部第8,老鹰15胜16负紧随其后位列第9。本场比赛胜负将直接影...

寒武纪借DeepSeek东风扭亏为盈 上半年利润创纪录

寒武纪借DeepSeek东风扭亏为盈 上半年利润创纪录

  科技股份有限公司扭亏为盈,上半年利润创下纪录。DeepSeek掀起人工智能热潮后,中国鼓励使用本土研发技术,带动市场对国产芯片的需求激增。   这家中国人工智能芯片设...

DeepSeek横空出世与“河出图、洛出书” ——《东方智慧与AI新文明》新书分

DeepSeek横空出世与“河出图、洛出书” ——《东方智慧与AI新文明》新书分

  分享会上,李可系统阐释了新书的核心要义。他以“河图洛书”——这一被誉为中华文明元启蒙的文化符号为隐喻,深入探讨以DeepSeek为代表的大模型所承载的当代“启示”意义。李可指出,Dee...

DeepSeek-V3.1发布:国产算力生态跃迁新纪元

DeepSeek-V3.1发布:国产算力生态跃迁新纪元

  DeepSeek最新发布的V3.1大模型,通过自研的UE8M0 FP8精度标准,首次实现了从算法架构到硬件适配的全栈国产化协同。该技术通过动态调整浮点数的尾数与指数位分配,在国产芯片制...

2025赤水河论坛丨DeepSeek揭秘烈酒“MBTI”

2025赤水河论坛丨DeepSeek揭秘烈酒“MBTI”

  镇举行。在拥抱Z世代分论坛上“中西酒文化MBTI大揭秘”环节,主办方基于人工智能分析平台DeepSeek的分析,发布了一份趣味十足的烈酒“性格”报告,为多款中外知名烈酒标注了MBTI人...