当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek宣布开源DeepGEMM

2个月前 (02-26)Deepseek最新资讯145

【DeepSeek宣布开源DeepGEMM】

财联社2月26日电,Deepseek于开源周第三天宣布开源DeepGEMM。DeepGEMM 是一个专为简洁高效的 FP8 通用矩阵乘法(GEMM)设计的库,具有细粒度缩放功能,如 DeepSeek-V3 中所提出。它支持普通和混合专家(MoE)分组的 GEMM。该库采用 CUDA 编写,在安装过程中无需编译,通过使用轻量级的即时编译(JIT)模块在运行时编译所有内核。FP8GEMM库,为V3/R1训练和推理提供支持。


“DeepSeek宣布开源DeepGEMM” 的相关文章

蚂蚁集团或布局AI智能眼镜产品 DeepSeek加速终端落地

蚂蚁集团或布局AI智能眼镜产品 DeepSeek加速终端落地

据科技媒体报道,蚂蚁集团正在招聘AI智能眼镜的产品专家。根据职位描述可知,该职位主要负责AI智能眼镜应用相关的产品,要求有2C产品的经验,并且熟悉市面上各位VR、AR和AI智能眼镜。这则招聘信息或显示...

DeepSeek在政务服务智能审批中有哪些应用场景

DeepSeek在政务服务智能审批中有哪些应用场景

DeepSeek在政务服务智能审批中有多个应用场景,这些场景充分展示了其在提升政务服务效率和质量方面的潜力。以下是DeepSeek在政务服务智能审批中的主要应用场景:1. 智能咨询服务全方位智能咨询:...

息壤+DeepSeek,湖南电信AI数字化产品矩阵重磅发布

息壤+DeepSeek,湖南电信AI数字化产品矩阵重磅发布

红网时刻新闻2月15日讯(记者 向婉)DeepSeek凭借强大的自然语言处理与多模态能力,在代码生成、数据分析、学术研究、智能办公等领域表现卓越。自发布以来,其开源项目数已超越OpenAI,全球下载量...

关于DeepSeek V3/R1 Decoding吞吐极限的估计

关于DeepSeek V3/R1 Decoding吞吐极限的估计

经历了一周DeepSeek的打脸活动后,周六 DeepSeek终于开大放出来了自身的推理系统水平,DeepSeek:DeepSeek-V3 / R1 推理系统概览 。在这个结论放出来之前,没...

同程旅行宣布接入DeepSeek大模型,打造一站式智能旅行服务

同程旅行宣布接入DeepSeek大模型,打造一站式智能旅行服务

3月3日消息,同程旅行日前宣布其自主研发的旅游行业专属模型——同程程心大模型将全面接入DeepSeek,成为首家接入DeepSeek大模型的在线旅游平台(OTA)。目前,该功能已进入内测阶段,预计3月...

彬州市教育局开展Deepseek与教学融合创新专题培训

彬州市教育局开展Deepseek与教学融合创新专题培训

为贯彻落实教育部《教育数字化转型战略行动》部署要求,推动AI与教育教学的深度融合,全面提升我市教师数字素养,3月14日,彬州市教育局联合中国电信集团彬州市分公司在城关第二小学举办了“Deepseek与...