当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek联合清北发布DualPath推理框架:吞吐量提升近2倍

6个月前 (02-27)Deepseek最新资讯62

  2月27日消息,依旧没等到DeepSeek V4,今天DeepSeek与北京大学、清华大学在ArXiv联合发布了一篇关于全新智能体推理框架DualPath的论文。据了解,该框架旨在解决智能体在长文本推理场景下面临的I/O瓶颈问题,通过优化存储读取路径,显著提升了大规模模型的推理吞吐量deepseek

  据论文介绍,DualPath的核心创新在于改变了传统的“存储至预填充引擎”(Storage-to-Prefill)单路径加载模式,引入了“存储至解码引擎”(Storage-to-Decode)的第二条路径。在现有的预填充-解码分离架构中,存储I/O压力往往集中在预填充引擎上,导致解码引擎的存储带宽闲置,这种不平衡成为了限制系统吞吐量的障碍。DualPath通过利用解码引擎闲置的存储网卡带宽读取缓存,并配合高速计算网络(RDMA)将其传输至预填充引擎,实现了集群存储带宽的全局池化与动态负载均衡。

  在技术实现上,DualPath采用了以计算网卡为中心的流量管理和自适应请求调度机制。系统将所有GPU相关流量统一管理,利用服务质量(QoS)机制确保推理通信的高优先级,保证大规模数据传输不干扰延迟敏感型任务。同时,调度器能实时监控各引擎负载,动态决定最优路径,减少GPU执行过程中的闲置时间。

  数据显示,研究团队在包含1152个GPU的大规模生产集群上,使用660B规模的模型进行了实测。结果表明,DualPath在离线推理场景下的吞吐量提高了1.87倍,在线服务场景下的吞吐量平均提升了1.96倍。此外,在高负载环境下,首字延迟(TTFT)得到大幅优化,而Token间的生成速度几乎未受干扰。(袁宁)原文出处:DeepSeek联合清北发布DualPath推理框架:吞吐量提升近2倍,感谢原作者,侵权必删!

标签: deepseek

“DeepSeek联合清北发布DualPath推理框架:吞吐量提升近2倍” 的相关文章

华为算力链爆发:Deepseek V4 模型驱动下的国产算力产业链投资机遇

华为算力链爆发:Deepseek V4 模型驱动下的国产算力产业链投资机遇

  2026 年 2 月 26 日,AI 大模型厂商 Deepseek 宣布其万亿参数旗舰模型 V4 将独家允许华为提前访问并进行适配优化,暂未向英伟达、AMD 开放。这一决策打破了 AI...

DeepSeek V3.2、GLM4.6等大模型即将发布

DeepSeek V3.2、GLM4.6等大模型即将发布

  DeepSeek-V3.2即将发布,据了解,v3.2-base已上传至DeepSeek的HuggingFace官方页面,模型文件正在上传中,不过目前已下线。同时,智谱GLM4.6也即将...

DeepSeek V4春节发布计划存疑,豆包、GLM等国产AI模型扎堆抢档

DeepSeek V4春节发布计划存疑,豆包、GLM等国产AI模型扎堆抢档

  备受期待的DeepSeek V4可能不会在春节期间发布。据南华早报援引消息人士爆料,DeepSeek官方近期对此保持沉默,预计V4不会如期亮相,但未说明具体原因。该人士称公司将继续推送...

刚刚,DeepSeek-V3.1「终极版」重磅发布!最大提升超36%,V4R2还

刚刚,DeepSeek-V3.1「终极版」重磅发布!最大提升超36%,V4R2还

  值得一提的是,新模型在Humanitys Last Exam(人类最后的考试)中,成绩提升幅度高达36.48%!   这一Bug已经导致DeepSeek V3.1无法...

国产AI助手DeepSeek交互风格转变引争议

国产AI助手DeepSeek交互风格转变引争议

  近日,国产AI助手DeepSeek因技术升级后交互风格从细腻共情转向简洁理性deepseek,被用户吐槽“变冷淡”,引发全网关于“AI是否在假装关心”的热议,甚至催生出话题#DeepS...

1月11日DeepSeek预测:独行侠vs公牛,戴维斯缺阵恐难阻武切维奇率队主场

1月11日DeepSeek预测:独行侠vs公牛,戴维斯缺阵恐难阻武切维奇率队主场

  芝加哥公牛将在联合中心迎战达拉斯独行侠,这是两支近期状态起伏的球队之间的较量。公牛目前以17胜20负排名东部第10,而独行侠则以14胜24负位列西部第12。这场比赛对两队来说都至关重要...