当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek发布开源周首个成果 可优化英伟达GPU效率

2年前 (2025-02-24)Deepseek最新资讯623

新京报贝壳财经讯(记者罗亦丹)北京时间2月24日上午,DeepSeek发布了其“开源周”的第一项成果:FlashMLA(直译为快速多头潜在注意力机制)的代码。


据了解,MLA(多头潜在注意力机制)正是DeepSeek降低大模型成本使用的关键技术之一,其可以显著减少大模型训练和推理过程中的内存占用,而FlashMLA则是针对Hopper GPU(一种英伟达GPU架构)开发的高效MLA解码内核,其针对可变长度序列进行了优化,目前已投入了生产,其可以使得H800达到3000GB/s内存,实现580TFLOPS(每秒浮点运算次数)计算性能。


贝壳财经记者注意到,根据此前DeepSeek发布V3大模型时公开的技术文档,该大模型正是使用英伟达的H800芯片训练而成。


上海骊翰科技咨询有限公司发文称,FlashMLA能在不损失模型性能的前提下,将缓存体积压缩至原来的1/4,从而大幅降低显存需求。例如,原始需要存储的100GB中间结果,压缩后仅需25GB,通过开源让企业可以直接使用FlashMLA来优化自家模型。随着FlashMLA的普及,AI推理有望进入千元级硬件跑百亿模型的时代。


“DeepSeek发布开源周首个成果 可优化英伟达GPU效率” 的相关文章

从“学术助手”到“吐槽利器 ” 高校学生掀起DeepSeek另类应用

从“学术助手”到“吐槽利器 ” 高校学生掀起DeepSeek另类应用

《科创板日报》2月16日讯(实习记者 姚桐 记者 毛明江)近日,国内多所高校学生群体中掀起一股使用DeepSeek“锐评”母校及学科专业的热潮。为何年轻人选择用AI工具表达对教育体系的看法?背后折射出...

多地组织干部学用DeepSeek!专家称人员要调整观念

多地组织干部学用DeepSeek!专家称人员要调整观念

在各地政务系统密集宣布接入DeepSeek的同时,苏州、郑州、来宾、延安等地也掀起了一阵组织领导干部学用人工智能辅助决策、拥抱新技术的热潮。2月18日,清华大学新闻学院、人工智能学院双聘教授沈阳在接受...

从DeepSeek看人工智能自主创新的战略价值

从DeepSeek看人工智能自主创新的战略价值

作者:彭一杰(北京大学光华管理学院研究员、人工智能研究院多智能体与社会智能中心主任)随着全球科技竞争的加剧,人工智能已成为国家竞争力的重要标志。无论是国家还是行业、个人,都在积极探索如何利用人工智能赋...

多家医院完成DeepSeek本地化部署,数据安全与患者隐私保护很重要

多家医院完成DeepSeek本地化部署,数据安全与患者隐私保护很重要

(人民日报健康客户端记者 乔芮 王艾冰)2月13日,成都市第一人民医院宣布在全市率先成功完成DeepSeek本地化部署。据人民日报健康客户端记者不完全统计,截至目前,深圳大学附属华南医院、上海市第六人...

浅谈DeepSeek对于数据分析师的赋能

浅谈DeepSeek对于数据分析师的赋能

在数据驱动决策的时代,效率就是生产力。DeepSeek作为AI助手,如何帮助数据分析师解放双手、提升10-100倍效率?本文带你深入了解这一革命性工具。引言数据分析师的日常是什么?清洗数据、探索关系、...

马儿主动到派出所“求助”,武汉民警用DeepSeek助力其“回家”

马儿主动到派出所“求助”,武汉民警用DeepSeek助力其“回家”

明亮的路灯下,在武汉市公安局轨道交通管理分局汉新派出所门口,突然出现4匹高头大马在溜达撒欢。2月27日晚上9时许,汉新派出所的民警辅警发现后,使用Deepseek搜索出几条附近马场的信息,很快联系上马...