当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek开源周第三日 发布高性能通用矩阵乘法库

8个月前 (02-26)Deepseek最新资讯462

新京报贝壳财经讯(记者罗亦丹)北京时间2月26日,DeepSeek进行了其开源周第三日的发布——DeepGEMM,一个支持密集和MoE(专家混合模型)GEMM(通用矩阵乘法)的FP8 (8位浮点数)GEMM库,为V3/R1训练和推理提供支持。

据了解,通用矩阵乘法是许多高性能计算任务的核心,所以其性能优化也是大模型降本增效的重点。

DeepSeek表示,DeepGEMM在Hopper GPU(一种英伟达GPU架构)上最高可达到1350+FP8TFLOPS(每秒万亿次浮点运算),并且像教程一样简洁,可完全即时编译,其核心逻辑只有约300行代码,且在大多数矩阵尺寸上均优于专家调优的内核,并支持密集布局和两种MoE布局。


标签: DeepSeek

“DeepSeek开源周第三日 发布高性能通用矩阵乘法库” 的相关文章

亚信科技与清华AIR联合发布《DeepSeek赋能自智网络高阶演进评测报告

亚信科技与清华AIR联合发布《DeepSeek赋能自智网络高阶演进评测报告

2025年2月28日,亚信科技与清华大学智能产业研究院(AIR)联合发布《DeepSeek赋能自智网络高阶演进评测报告》中英文版。该报告为通信行业首份系统性评估DeepSeek等基础大模型对自智网络应...

DeepSeek助攻年轻人的口腔护理,一刷一含一漱健康从“齿”开始

DeepSeek助攻年轻人的口腔护理,一刷一含一漱健康从“齿”开始

你是不是也有这样的困扰:早上刷牙时牙龈出血,喝冰咖啡时牙齿敏感,吃完火锅后口腔异味挥之不去……别急,这些问题,DeepSeek用大数据告诉你:90%的年轻人都中招了!但好消息是,解决这些问题其实很简单...

《DeepSeek实战指南:从数据到财富》出版发行

《DeepSeek实战指南:从数据到财富》出版发行

近日,新华出版社推出人工智能领域新作《DeepSeek实战指南:从数据到财富》,该书深度解析中国大语言模型领域的“破局者”DeepSeek,指导读者在数据洪流中捕捉财富机遇,现已面向全国发行。该书深入...

接入DeepSeek后,到底能干些什么?

接入DeepSeek后,到底能干些什么?

近期,DeepSeek访问使用量急速上升,已经成为目前最快突破3000万日活跃用户量的应用程序。记者从工业和信息化部了解到,三家基础电信企业已全面接入国产开源大模型DeepSeek。除了运营商的云平台...

法律人118个常用DeepSeek提示词,0基础必看!!

法律人118个常用DeepSeek提示词,0基础必看!!

一、合同管理(15个)1.智能起草:生成跨境电商平台服务协议模板,包含数据跨境传输条款和不可抗力情形说明2.条款审核:用《民法典》合同编逐条审查技术开发合同,自动标注权利义务不对等条款(重点核查知识产...

硅基流动SiliconCloud平台上线DeepSeek-V3新版本

硅基流动SiliconCloud平台上线DeepSeek-V3新版本

3月27日,硅基流动宣布,硅基流动SiliconCloud平台的Pro版与普通版 DeepSeek-V3现均已完成升级,且同样基于华为云昇腾云部署推理服务。新版本 DeepSeek-V3的价格与API...