当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek开源周第三日 发布高性能通用矩阵乘法库

5个月前 (02-26)Deepseek最新资讯318

新京报贝壳财经讯(记者罗亦丹)北京时间2月26日,DeepSeek进行了其开源周第三日的发布——DeepGEMM,一个支持密集和MoE(专家混合模型)GEMM(通用矩阵乘法)的FP8 (8位浮点数)GEMM库,为V3/R1训练和推理提供支持。

据了解,通用矩阵乘法是许多高性能计算任务的核心,所以其性能优化也是大模型降本增效的重点。

DeepSeek表示,DeepGEMM在Hopper GPU(一种英伟达GPU架构)上最高可达到1350+FP8TFLOPS(每秒万亿次浮点运算),并且像教程一样简洁,可完全即时编译,其核心逻辑只有约300行代码,且在大多数矩阵尺寸上均优于专家调优的内核,并支持密集布局和两种MoE布局。


标签: DeepSeek

“DeepSeek开源周第三日 发布高性能通用矩阵乘法库” 的相关文章

推荐大家阅读这本书:《DeepSeek全攻略 人人需要的AI通识课》

推荐大家阅读这本书:《DeepSeek全攻略 人人需要的AI通识课》

该书以对话问答的形式,将复杂的AI技术概念转化为易于理解的通俗语言,从基础知识到应用实践,从理论讲解到案例分析,深入浅出地介绍了AI技术的核心原理和应用方法,为大家提供了全面的AI通识认知框架。值得一...

DeepSeek详细介绍DeepSeek在商业咨询领域有哪些重要应用场景?

DeepSeek详细介绍DeepSeek在商业咨询领域有哪些重要应用场景?

DeepSeek详细介绍DeepSeek在商业咨询领域有哪些重要应用场景?<think> 嗯,用户之前问过DeepSeek在科技领域哪些应用场景,我详细回答了自动驾驶、智能视频、推荐、助...

从算力底座到生态繁荣 昇腾如何为江苏AI新纪元铺路?

从算力底座到生态繁荣 昇腾如何为江苏AI新纪元铺路?

 从数智赋能公共服务水平提升,到大模型本地部署打造数智员工,再到AI+警务、AI+医疗、AI+办公等行业应用释放新质生产力……  在前不久的“激发新质动能 智绘江苏蓝图”主题媒体探营暨“昇腾新动力 D...

当涂政务系统接入DeepSeek

当涂政务系统接入DeepSeek

近日,当涂县数据资源管理局创新引入DeepSeek自然语言处理技术政务信息化项目审核。实现了从“经验判断”到“数据决策”的跨越式发展。专业数据库支撑,打造项目审核“最强大脑”。与其他通用AI系统不同,...

捷停车上线“DeepSeek停车助手”,车场车位“一问”直达

捷停车上线“DeepSeek停车助手”,车场车位“一问”直达

最近,越来越多车主发现,打开捷停车小程序首页,可以直接让AI帮忙找场找位,甚至还能问它现场能不能充电、购买停车套餐等。目前,DeepSeek停车助手已在捷停车微信小程序正式上线,面向平台车主开放体验,...

企业微信接入DeepSeek,可一键生成24小时“智能助理”

企业微信接入DeepSeek,可一键生成24小时“智能助理”

2月21日,上游新闻记者从腾讯了解到,今日企业微信新版本上线,正式发布“智能机器人”、“智能表格-客户跟进总结”等AI功能,灰度接入满血版DeepSeek-R1大模型。企业可一键创建基于内部知识库的专...