当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek开源周连续“放大招”

7个月前 (02-25)Deepseek最新资讯350

2月24日消息

DeepSeek宣布启动

“开源周”(Open Source Week)

计划连续5天(2月24日至28日)

陆续开源5个代码库

网友们对此举纷纷点赞称:

“DeepSeek王炸开局”

“‘源’神启动!”

图源:网络

FlashMLA让AI大模型低成本却有高性能

首个开源的项目是FlashMLA

可谓是第一天就“放大招”!

DeepSeek首日开源内容公告 图源:X

FlashMLA是

DeepSeek针对

英伟达Hopper架构GPU优化的

高效MLA解码内核

(MLA即多头潜在注意力)

可理解为

专为高性能显卡设计的

“AI加速工具”

现在已经投入生产使用

简而言之

FlashMLA能够让AI大模型

在H800这样的GPU上

跑得更快、更高效

当AI同时处理长句子和短句子时

FlashMLA

能动态调整资源分配

避免浪费算力

网友称赞DeepSeek是真正的“Open AI”图源:X

根据此前公开发布的

DeepSeek V3大模型技术文档

该大模型正是使用

H800芯片训练而成

自从V2模型开始

MLA就已帮助DeepSeek

在一系列模型中实现成本大幅降低

但计算、推理性能

仍能与顶尖模型持平

DeepEP让专业答案更高效精准

2月25日

DeepSeek再度官宣

当日开源代码库为DeepEP

即首个用于MoE(混合专家)模型

训练和推理的

开源EP(专家并行)通信库

据报道

MLA和MoE也被认为是

DeepSeek以低成本

实现杰出表现的核心原因

DeepSeek25日开源内容公告 图源:X

MoE架构的缺点之一

是会增加通信成本

而EP通信库正是

针对通信环节的优化

可以实现高效、优化的全员沟通

适配现代高性能计算需求等

值得一提的是

在宣布开源20分钟内

DeepEP便已在GitHub上

获得超1000个收藏

受到大量关注

推动AI普惠发展也要守住底线

最新数据显示

2月24日

DeepSeek-R1

在国际知名开源社区Hugging Face上

已获得超过一万个赞

成为该平台

近150万个公开模型中

最受欢迎的开源大模型之一

作为开源社区的“顶流”

DeepSeek以完全透明的方式

与全球开发者社区

分享最新的研究进展

希望加速行业发展进程

由于DeepSeek的图标

是一只鲸鱼

有网友生动地描述称

“这条鲸鱼正在掀起波浪”

(The whale is making waves)

与此同时

在DeepSeek获得广泛关注之际

有人却动起了“歪脑筋”

中国国家知识产权局

日前发布通告

依法对抢注“DEEPSEEK”等

63件商标注册申请

予以驳回

这些商标恶意注册申请

明显具有“蹭热点”

谋取不当利益的意图

有业内人士建议

在各个领域接入AI大模型

国际社会期待各个行业

迎来新“智”变的今天

要正确处理技术创新与

资本投入和人类发展的关系

让更多人享受到AI技术红利

同时要守住AI发展红线

警惕技术发展过程中

可能出现的危机

撰文:孔繁鑫 编辑:雷渺鑫排版:李汶键 统筹:李政葳

参考:新华社、中国青年报、证券时报、新京报、扬子晚报、每日经济新闻、观察者网、新浪科技、腾讯科技

来源:世界互联网大会


“DeepSeek开源周连续“放大招”” 的相关文章

《财富》:2025年中国科技50强华为DeepSeek入选

《财富》:2025年中国科技50强华为DeepSeek入选

  除上述三家公司,登上榜单的还有阿里巴巴、腾讯科技、比亚迪deepseek、字节跳动、宇树科技、大疆创新、联想等。   关于华为,该榜单评价称,华为是中国最具全球竞争力...

DeepSeek预测:狼队VS曼城!哈兰德率队血洗莫利纽,瓜帅开启卫冕之路

DeepSeek预测:狼队VS曼城!哈兰德率队血洗莫利纽,瓜帅开启卫冕之路

  英超2025赛季揭幕战即将打响!狼队坐镇莫利纽球场迎战卫冕冠军曼城。上赛季勉强保级的狼队,首轮就要面对四连冠的蓝月亮,这场“饿狼斗土豪”的戏码充满看点。   狼队上赛...

“云枢”DeepSeek大模型一体机在石家庄发布聚焦政企用户核心需求破解了算力部署复杂、技术门槛高、安全可控难等核心问题

“云枢”DeepSeek大模型一体机在石家庄发布聚焦政企用户核心需求破解了算力部署复杂、技术门槛高、安全可控难等核心问题

3月1日,“云枢”DeepSeek大模型一体机在石家庄市鹿泉区正式发布。该产品由河北神奕信息科技有限公司自主研发,旨在为党政机关及企事业单位提供集算力支撑、模型服务、安全防护与应用开发于一体的全栈式解...

快手旗下快影接入DeepSeek-R1满血版

快手旗下快影接入DeepSeek-R1满血版

快手旗下剪辑软件快影正式接入DeepSeek-R1满血版,成为行业首批接入DeepSeek能力的剪辑工具。快影将融合DeepSeek-R1模型技术,并加持可灵AI视频生成能力,集成文案成片、小说漫、A...

Deepseek推荐全国旅游百强县市第98名:浙江平阳县

Deepseek推荐全国旅游百强县市第98名:浙江平阳县

  日前,全国县镇发展研究课题组、天和经济研究所县镇发展研究院联合发布了2024《全国县镇发展报告》,报告评价篇对全国县市以及包含乡村人口的市辖区旅游发展水平进行了综合评价,并发布了天和2...

中兴通讯AiCube DeepSeek一体机亮相MWC25,助力大模型商业化加速

中兴通讯AiCube DeepSeek一体机亮相MWC25,助力大模型商业化加速

在世界移动通信大会(MWC25巴塞罗那)上,中兴通讯隆重推出了AiCube DeepSeek一体机,为全球企业带来了高效的大模型商业化解决方案,助力千行百业数智化升级。在全球AI技术竞争日益激烈的背景...