当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek发布开源周首个成果 可优化英伟达GPU效率

1年前 (2025-02-24)Deepseek最新资讯606

新京报贝壳财经讯(记者罗亦丹)北京时间2月24日上午,DeepSeek发布了其“开源周”的第一项成果:FlashMLA(直译为快速多头潜在注意力机制)的代码。


据了解,MLA(多头潜在注意力机制)正是DeepSeek降低大模型成本使用的关键技术之一,其可以显著减少大模型训练和推理过程中的内存占用,而FlashMLA则是针对Hopper GPU(一种英伟达GPU架构)开发的高效MLA解码内核,其针对可变长度序列进行了优化,目前已投入了生产,其可以使得H800达到3000GB/s内存,实现580TFLOPS(每秒浮点运算次数)计算性能。


贝壳财经记者注意到,根据此前DeepSeek发布V3大模型时公开的技术文档,该大模型正是使用英伟达的H800芯片训练而成。


上海骊翰科技咨询有限公司发文称,FlashMLA能在不损失模型性能的前提下,将缓存体积压缩至原来的1/4,从而大幅降低显存需求。例如,原始需要存储的100GB中间结果,压缩后仅需25GB,通过开源让企业可以直接使用FlashMLA来优化自家模型。随着FlashMLA的普及,AI推理有望进入千元级硬件跑百亿模型的时代。


“DeepSeek发布开源周首个成果 可优化英伟达GPU效率” 的相关文章

百度首页上线DeepSeek入口链接-AI搜索DeepSeek满血版”即可体验

百度首页上线DeepSeek入口链接-AI搜索DeepSeek满血版”即可体验

记者获悉,百度搜索目前已全量上线DeepSeek满血版并提供联网服务,其中PC端开放1小时超千万人使用。对比其它接入DeepSeek产品,百度搜索在首页搜索框下方点击“AI搜索DeepSeek满血版”...

DeepSeek“引爆”博鳌!AI将像水电一样人人可用

DeepSeek“引爆”博鳌!AI将像水电一样人人可用

当时间步入博鳌亚洲论坛2025年年会第二天,这场盛会迎来议程最繁忙的阶段,人工智能毫无悬念地成为中外嘉宾瞩目的“C位”。从现场令人惊叹的科技展示,到分论坛上唇枪舌剑的思想交锋,AI热度持续飙升。有嘉宾...

“博惠办”DeepSeek智能服务正式上线!

“博惠办”DeepSeek智能服务正式上线!

当“国产AI之光”DeepSeek接入政务服务,将会带来怎样的加速度?博山区行政审批服务局将AI大模型技术运用于政务服务智能问答场景,推出“博惠办”DeepSeek智能政服,为企业群众提供智能化、便捷...

DeepSeek团队为什么无视泼天的财富?

DeepSeek团队为什么无视泼天的财富?

 2025(第17届)商界木兰年会于4月18日-19日在北京召开。明势创投创始合伙人黄明明表示,中国最优秀的头部模型公司要“将军赶路不追小兔”,而是朝着人类文明的更高峰去攀登。  春节期间,DeepS...

国有大行加速布局DeepSeek 推动金融服务从“信息化”迈向“认知化”

国有大行加速布局DeepSeek 推动金融服务从“信息化”迈向“认知化”

21世纪经济报道记者 张欣 北京报道3月8日,工商银行宣布在同业中率先完成 DeepSeek 最新开源大模型的私有化部署,并将其接入行内“工银智涌”大模型矩阵体系,有力推动金融业务场景的智能化升级。据...

普通人如何玩转DeepSeek 别再被付费AI教程“套路”了!

普通人如何玩转DeepSeek 别再被付费AI教程“套路”了!

近日,国产大模型DeepSeek在AI界“大杀四方”,各类付费教程也不断涌现,有人甚至靠卖课进账数十万元。在这场狂欢中,普通人既看到了赚钱门道,也面临着“被套路”的风险。那么,作为普通人,要如何用好D...