当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek开源周第三日 发布高性能通用矩阵乘法库

2个月前 (02-26)Deepseek最新资讯169

新京报贝壳财经讯(记者罗亦丹)北京时间2月26日,DeepSeek进行了其开源周第三日的发布——DeepGEMM,一个支持密集和MoE(专家混合模型)GEMM(通用矩阵乘法)的FP8 (8位浮点数)GEMM库,为V3/R1训练和推理提供支持。

据了解,通用矩阵乘法是许多高性能计算任务的核心,所以其性能优化也是大模型降本增效的重点。

DeepSeek表示,DeepGEMM在Hopper GPU(一种英伟达GPU架构)上最高可达到1350+FP8TFLOPS(每秒万亿次浮点运算),并且像教程一样简洁,可完全即时编译,其核心逻辑只有约300行代码,且在大多数矩阵尺寸上均优于专家调优的内核,并支持密集布局和两种MoE布局。


标签: DeepSeek

“DeepSeek开源周第三日 发布高性能通用矩阵乘法库” 的相关文章

DeepSeek能干什么?搜论文、学代码……多所高校接入的DeepSeek“满血版”有哪些神奇之处?

DeepSeek能干什么?搜论文、学代码……多所高校接入的DeepSeek“满血版”有哪些神奇之处?

新学期,多所高校掀起了智能化革新浪潮。中国人民大学、华东师范大学、北京邮电大学等高校正式接入了DeepSeek“满血版”。这个拥有6710亿参数的“超级大脑”,正在以每周迭代的领域知识和强大的“思维链...

快递物流行业迎来“DeepSeek时刻”,以AI重构“速度-成本”最优解

快递物流行业迎来“DeepSeek时刻”,以AI重构“速度-成本”最优解

曾几何时,AI领域信奉“大力出奇迹”,随着DeepSeek横空出世,以“四两拨千斤”的创新路径,仅以数百万美元的训练成本就实现了Chat-GPT4的同等性能,同时参数量也仅为对手的几十分之一。这就是D...

“内置DeepSeek”,日媒:AI成中国汽车新卖点

“内置DeepSeek”,日媒:AI成中国汽车新卖点

东风日产的N7电动汽车将搭载DeepSeek凤凰网科技讯 北京时间3月24日,据《日经亚洲》报道,中国汽车公司正在将DeepSeek的AI功能添加到旗下车型中,以便在中国这个全球最大汽车市场中脱颖而出...

沈阳市注评行业党委举办DeepSeek专题培训班,以科技赋能行业提质增效

沈阳市注评行业党委举办DeepSeek专题培训班,以科技赋能行业提质增效

为提升注册会计师和资产评估行业从业人员专业能力与新技术应用水平,促进DeepSeek技术在注评行业内的普及与应用,沈阳市注评行业党委分阶段、分主题开展沈阳市注评行业DeepSeek专题培训班,通过前沿...

深圳大学与腾讯云达成合作 推出DeepSeek相关课程

深圳大学与腾讯云达成合作 推出DeepSeek相关课程

每经快讯,据深圳大学微信公众号2月17日消息,深圳大学大数据系统计算技术国家工程实验室近日与腾讯云达成合作,共同推出基于DeepSeek的人工智能通识课程。深大学生本学期即可选课学习。课程内容将涵盖人...

传音控股:传音控股旗下Infinix、TECNO品牌已接入DeepSeek

传音控股:传音控股旗下Infinix、TECNO品牌已接入DeepSeek

每经AI快讯,有投资者在投资者互动平台提问:董秘您好!请问贵公司是否已经部署了DeepSeek?如果已经部署了,请问主要应用于哪些具体的业务?公司接入DeepSeek有哪些成本、收益方面的考量?如果公...