当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek发布开源周首个成果 可优化英伟达GPU效率

8个月前 (02-25)Deepseek最新资讯420

新京报贝壳财经讯(记者罗亦丹)北京时间2月24日上午,DeepSeek发布了其“开源周”的第一项成果:FlashMLA(直译为快速多头潜在注意力机制)的代码。

据了解,MLA(多头潜在注意力机制)正是DeepSeek降低大模型成本使用的关键技术之一,其可以显著减少大模型训练和推理过程中的内存占用,而FlashMLA则是针对Hopper GPU(一种英伟达GPU架构)开发的高效MLA解码内核,其针对可变长度序列进行了优化,目前已投入了生产,其可以使得H800达到3000GB/s内存,实现580TFLOPS(每秒浮点运算次数)计算性能。

贝壳财经记者注意到,根据此前DeepSeek发布V3大模型时公开的技术文档,该大模型正是使用英伟达的H800芯片训练而成。

上海骊翰科技咨询有限公司发文称,FlashMLA能在不损失模型性能的前提下,将缓存体积压缩至原来的1/4,从而大幅降低显存需求。例如,原始需要存储的100GB中间结果,压缩后仅需25GB,通过开源让企业可以直接使用FlashMLA来优化自家模型。随着FlashMLA的普及,AI推理有望进入千元级硬件跑百亿模型的时代。


“DeepSeek发布开源周首个成果 可优化英伟达GPU效率” 的相关文章

大模型落地家庭娱乐场景 三星电视接入DeepSeek-R1

大模型落地家庭娱乐场景 三星电视接入DeepSeek-R1

近日,三星电视正式接入DeepSeek-R1,AI能力进一步得到强化。据悉,用户无需复杂的操作步骤,唤醒智能语音助手三星小贝,在对应的语音助手对话页面内,即可便捷体验深度思考功能。三星电视融合Deep...

DeepSeek官方企业咨询账号在用户群中回应称,“辟谣:R2发布为假消息”

DeepSeek官方企业咨询账号在用户群中回应称,“辟谣:R2发布为假消息”

【消息称DeepSeek-R2或下周发布 官方暂无回应】财联社3月11日电,有消息称,DeepSeek下一代AI模型DeepSeek-R2或提前于下周一(3月17日)正式发布。截至目前,DeepSee...

神州鲲泰问学一体机DeepSeek版发布 垂直场景深度赋能,破局企业AI落地难题

神州鲲泰问学一体机DeepSeek版发布 垂直场景深度赋能,破局企业AI落地难题

2025年2月28日,神州鲲泰问学一体机DeepSeek版在第三届北京人工智能产业创新发展大会上正式发布,以创新的技术能力和行业洞察力,为企业提供了高性价比的智能化升级方案。通过精准解决部署痛点,并提...

中信证券:看好DeepSeek新一代模型带动云端推理需求爆发

中信证券:看好DeepSeek新一代模型带动云端推理需求爆发

中信证券发布研报指出,DeepSeek通过工程化能力创新,实现了大模型训练和推理算力成本的极致优化,也为端侧部署高性能模型提供新的方向。中信证券看好DeepSeek新一代模型带动云端推理需求爆发,加速...

佛山市总开展DeepSeek智能实战应用系列培训

佛山市总开展DeepSeek智能实战应用系列培训

近日,广东省佛山市总工会举办DeepSeek智能实战应用系列公益培训班,吸引来自全市各机关事业单位、传统行业及家电家具、新能源、工业机器人、医药健康等行业职工参与。原定200人一场的培训规模因报名人数...

DeepSeek让观山湖区政务服务实现“边聊边办”

DeepSeek让观山湖区政务服务实现“边聊边办”

近期,贵州省政务服务中心依托国产大模型DeepSeek开发的“贵人智办”AI助手上线,观山湖区作为全省首批试点之一,该功能也在区政务大厅正式亮相。记者走进观山湖区政务大厅看到,B区的自助办理区及“7×...