当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek宣布开源DeepGEMM

7个月前 (02-26)Deepseek最新资讯398

【DeepSeek宣布开源DeepGEMM】

财联社2月26日电,Deepseek于开源周第三天宣布开源DeepGEMM。DeepGEMM 是一个专为简洁高效的 FP8 通用矩阵乘法(GEMM)设计的库,具有细粒度缩放功能,如 DeepSeek-V3 中所提出。它支持普通和混合专家(MoE)分组的 GEMM。该库采用 CUDA 编写,在安装过程中无需编译,通过使用轻量级的即时编译(JIT)模块在运行时编译所有内核。FP8GEMM库,为V3/R1训练和推理提供支持。


“DeepSeek宣布开源DeepGEMM” 的相关文章

湖南大模型+DeepSeek 助力智能诊疗

湖南大模型+DeepSeek 助力智能诊疗

湖南日报3月12日讯(全媒体记者 王铭俊)记者今天从智慧眼科技股份有限公司获悉,该公司大模型砭石与DeepSeek的本地化部署应用,已在长沙市第一医院落地。智慧眼人工智能研究院院长胡频博士介绍,“砭石...

DeepSeek本地部署,谁借“信息差”割韭菜?“解决”服务器繁忙从一分到百万元

DeepSeek本地部署,谁借“信息差”割韭菜?“解决”服务器繁忙从一分到百万元

“这本质上就是‘信息差’生意。”北京商报记者丨卢扬 程靓AI浪潮下,随着现象级应用DeepSeek爆火,市场上也兴起了“信息差”生意。临近“3·15”,有消费者反映,在本地部署DeepSeek时,容易...

从DeepSeek-R1看AI国产化的全球突围

从DeepSeek-R1看AI国产化的全球突围

近期,中国初创公司深度求索(DeepSeek)推出的大模型DeepSeek-R1引发全球关注。这款完全基于国产技术研发的AI产品,不仅在自然语言处理、多模态交互等领域展现出不逊于国际顶尖模型的性能,更...

全市首个!大兴人才服务平台用上DeepSeek大模型

全市首个!大兴人才服务平台用上DeepSeek大模型

 为深入推进北京高水平人才高地建设,进一步提升地区人才宣传服务质量,创新打造区级独立人才服务宣传综合展示平台,全面实施“求贤、集贤、礼贤”三大人才工程,努力实现人才服务“随时查”“掌上办”,助力区域产...

什么是“具身智能”?DeepSeek和专家分别如何解读

什么是“具身智能”?DeepSeek和专家分别如何解读

过去一年,我国新质生产力发展步伐明显加快。我国在全球创新指数中的排名上升到第11位,是十年来全球创新力提升最快的经济体。而今年的《政府工作报告》,对培育壮大新兴产业、未来产业,推动传统产业改造提升,激...

零一万物打算用DeepSeek赚钱了

零一万物打算用DeepSeek赚钱了

花费更多GPU和资源烧万亿参数大模型,还是做一个可以赚钱的商业公司,零一万物选择了后者,也因此成为“AI六小虎”中最早转向的公司。如今,零一万物朝着这一目标加速前进。3月17日,零一万物举办了一场线上...