当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek开源周第三日 发布高性能通用矩阵乘法库

8个月前 (02-26)Deepseek最新资讯471

新京报贝壳财经讯(记者罗亦丹)北京时间2月26日,DeepSeek进行了其开源周第三日的发布——DeepGEMM,一个支持密集和MoE(专家混合模型)GEMM(通用矩阵乘法)的FP8 (8位浮点数)GEMM库,为V3/R1训练和推理提供支持。

据了解,通用矩阵乘法是许多高性能计算任务的核心,所以其性能优化也是大模型降本增效的重点。

DeepSeek表示,DeepGEMM在Hopper GPU(一种英伟达GPU架构)上最高可达到1350+FP8TFLOPS(每秒万亿次浮点运算),并且像教程一样简洁,可完全即时编译,其核心逻辑只有约300行代码,且在大多数矩阵尺寸上均优于专家调优的内核,并支持密集布局和两种MoE布局。


标签: DeepSeek

“DeepSeek开源周第三日 发布高性能通用矩阵乘法库” 的相关文章

中公携手 DeepSeek,教资备考超轻松

中公携手 DeepSeek,教资备考超轻松

怀揣教育梦想,欲踏入教育行业,教师资格考试无疑是第一道门槛。中公教育敏锐洞察到这一需求,联合前沿的人工智能技术 DeepSeek,精心打造了一套独具创新性的备考方案,致力于为广大考生带来前所未有的备考...

西安高新区DeepSeek场景应用赋能企业高质量发展

西安高新区DeepSeek场景应用赋能企业高质量发展

近日,西安高新区工信局、企业党委“党建+企业会客厅”活动在都市之门成功举办。活动聚焦“向‘新’而行,求‘质’增效——DeepSeek场景应用赋能企业高质量发展”主题,重点破解企业数字化转型中面临的难题...

DeepSeek如何优化企业管理效能?

DeepSeek如何优化企业管理效能?

DeepSeek如何优化企业管理效能?思考和行动过程用户希望了解DeepSeek如何优化企业管理效能。DeepSeek作为一款开源的人工智能模型,具备强大的数据处理和分析能力,可能在企业管理中发挥重要...

DeepSeek在人工智能任务中表现如何

DeepSeek在人工智能任务中表现如何

DeepSeek在人工智能任务中表现出色,具体体现在以下几个方面:一、基准测试成绩优异DeepSeek-R1在数学、代码、自然语言推理等任务上展现出卓越的性能。在国外大模型排名Arena上,其基准测试...

全国首个!东胜一卫生院接入DeepSeek

全国首个!东胜一卫生院接入DeepSeek

东胜区罕台中心卫生院与国内领先的AI大模型场景落地企业百沐数智达成战略合作正式接入DeepSeek-R1“满血版”大模型成为全国首个将大模型技术应用于基层医疗服务场景的医疗机构东胜区罕台中心卫生院通过...

15+车企怕掉队,紧急宣布接入DeepSeek

15+车企怕掉队,紧急宣布接入DeepSeek

DeepSeek火爆全球,凭借一己之力,戳破英伟达算力“泡沫”,以低成本、开源、免费的形式“哪吒闹海”。这个中国的AI助手,拥有媲美ChatGPT的能力,甚至让美国战略部门高度重视。面对DeepSee...