当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek开源周第三日 发布高性能通用矩阵乘法库

2个月前 (02-26)Deepseek最新资讯165

新京报贝壳财经讯(记者罗亦丹)北京时间2月26日,DeepSeek进行了其开源周第三日的发布——DeepGEMM,一个支持密集和MoE(专家混合模型)GEMM(通用矩阵乘法)的FP8 (8位浮点数)GEMM库,为V3/R1训练和推理提供支持。

据了解,通用矩阵乘法是许多高性能计算任务的核心,所以其性能优化也是大模型降本增效的重点。

DeepSeek表示,DeepGEMM在Hopper GPU(一种英伟达GPU架构)上最高可达到1350+FP8TFLOPS(每秒万亿次浮点运算),并且像教程一样简洁,可完全即时编译,其核心逻辑只有约300行代码,且在大多数矩阵尺寸上均优于专家调优的内核,并支持密集布局和两种MoE布局。


标签: DeepSeek

“DeepSeek开源周第三日 发布高性能通用矩阵乘法库” 的相关文章

华厦眼科布局DeepSeek:以智能化转型驱动创新,迸发增长潜力

华厦眼科布局DeepSeek:以智能化转型驱动创新,迸发增长潜力

3月5日,华厦眼科DeepSeek模型本地化部署暨AI创新平台启动仪式盛大举行,标志着华厦眼科在人工智能与眼科医疗融合上迈出了重要一步,正式进入“AI协同守护全生命周期眼健康”的智慧医疗新时代!厦门大...

DeepSeek价格下调,API调用错峰时段降幅最高达75%

DeepSeek价格下调,API调用错峰时段降幅最高达75%

经快讯,2月26日,DeepSeek API开放平台宣布,即日起,北京时间每日00:30至08:30的夜间空闲时段,DeepSeek开放平台推出错峰优惠活动。在此期间,API调用价格大幅下调:Deep...

跟DeepSeek聊人体解剖学是一种什么体验?

跟DeepSeek聊人体解剖学是一种什么体验?

人工智能发展飞速,在专业医学课堂教学领域有什么新动向?广东有高校已率先在多个专业课程采用DeepSeek辅助。记者从广东药科大学获悉,日前,该校在智能医学工程、数字媒体技术、临床医学、预防医学四个专业...

文心一言:请详细介绍Deepseek在智能客服系统中的应用

文心一言:请详细介绍Deepseek在智能客服系统中的应用

文心一言:请详细介绍Deepseek在智能客服系统中的应用DeepSeek在智能客服系统中的应用为企业带来了显著的提升和变革。以下是对DeepSeek在智能客服系统中应用的详细介绍:一、提升复杂文本问...

北京大学联合华为发布全栈开源DeepSeek推理方案

北京大学联合华为发布全栈开源DeepSeek推理方案

据北京大学网站消息,近日,北京大学联合华为发布DeepSeek全栈开源推理方案。该方案基于北京大学自主研发的SCOW算力平台系统与鹤思调度系统,整合了DeepSeek、openEuler、MindSp...

deepseek的历史对话记录能保存多久?

deepseek的历史对话记录能保存多久?

deepseek的历史对话记录能保存多久?Deepseek的历史对话记录默认保存时间为180天。您可以在账户的历史记录页面查看和管理这些记录。如果需要长期保存重要对话,建议手动导出并备份。相关问题怎么...