当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek开源第一个用于混合专家模型训练和推理的高效专家并行通信库

8个月前 (02-25)Deepseek最新资讯454

【DeepSeek开源第一个用于混合专家模型训练和推理的高效专家并行通信库】财联社2月25日电,DeepSeek在“开源周”的第二天向公众开源了DeepEP。据介绍,DeepEP是第一个用于MoE(混合专家)模型训练和推理的EP(Expert Parallelism,专家并行)通信库,可以实现高效且优化的全对全通信,支持包括FP8在内的低精度运算,适配现代高性能计算需求。同时,DeepEP针对NVLink到RDMA的非对称带宽转发场景进行了深度优化,不仅提供了高吞吐量,还支持SM(Streaming Multiprocessors)数量控制,兼顾训练和推理任务的高吞吐量表现。对于延迟敏感的推理解码场景,DeepEP还提供了纯RDMA的低延迟内核,支持自适应路由,能实现更灵活的GPU资源控制,满足不同场景需求。

“DeepSeek开源第一个用于混合专家模型训练和推理的高效专家并行通信库” 的相关文章

腾讯:微信接入DeepSeek不使用用户信息和隐私,仅整合公众号等公开信息

腾讯:微信接入DeepSeek不使用用户信息和隐私,仅整合公众号等公开信息

微信回应灰度测试接入DeepSeek。2月16日,澎湃新闻记者获悉,微信搜一搜在调用混元大模型丰富AI搜索的同时,近日正式灰度测试接入DeepSeek。被灰度到的用户,可在对话框顶部搜索入口,看到“A...

百度AI搜索——不限量稳定使用DeepSeek-R1满血联网版

百度AI搜索——不限量稳定使用DeepSeek-R1满血联网版

百度AI搜索——不限量稳定使用DeepSeek-R1满血联网版AI搜索已接入满血联网版Deepseek-R1,一键开启深度思考,即可免费使用最新版Deepseek-R1完成各类推理任务。...

DeepSeek引发国际关注 外交部回应

DeepSeek引发国际关注 外交部回应

据央视新闻消息,2月10日,外交部发言人郭嘉昆主持例行记者会。有记者就深度求索(DeepSeek)引发国际社会广泛讨论一事提问。对此,郭嘉昆表示,具体的专业问题建议你向主管部门了解。我想强调的是,当前...

北京市监局通过百度智能云千帆接入DeepSeek

北京市监局通过百度智能云千帆接入DeepSeek

3月5日,据百度智能云消息,北京市市场监管局企业登记注册场景近日通过百度智能云千帆大模型平台接入DeepSeek大模型,实现企业登记注册业务24小时在线“智能咨询”服务。...

DeepSeek月访问量超ChatGPT成为全球增长最快的AI工具

DeepSeek月访问量超ChatGPT成为全球增长最快的AI工具

【DeepSeek月访问量超ChatGPT】财联社3月31日电,据AI分析平台aitools.xyz,DeepSeek已经成为全球增长最快的AI工具,其每月新增网站访问量已经超过OpenAI的Chat...

北京首个!顺义基础教育领域部署DeepSeek大模型

北京首个!顺义基础教育领域部署DeepSeek大模型

据北京顺义区消息,近日,顺义在北京市基础教育领域率先部署DeepSeek-R1人工智能大模型,以人工智能促进教育高质量发展,开启顺义智慧教育新篇章。顺义教委相关负责人表示,DeepSeek在教育领域的...