当前位置:首页 > DeepSeek技术交流 > 正文内容

《自然》网站:中国AI模型“又一个DeepSeek时刻”

23小时前DeepSeek技术交流38

新华社伦敦7月16日电(记者郭爽)英国《自然》杂志网站16日发表文章说,中国人工智能(AI)模型Kimi K2发布后引发轰动,世界迎来“又一个DeepSeek时刻”。中国在6个月内推出第二款令人印象深刻的模型,表明这一成功并非偶然。文章摘要如下:

继今年1月DeepSeek-R1震惊世界之后,全球研究人员对中国推出的第二个强大的AI模型越来越感到兴奋。北京月之暗面科技有限公司于7月11日推出了Kimi K2。

Kimi K2在编程方面的表现尤其出色,在LiveCodeBench(一个专门用于评估大型语言模型编码能力的数据集)等测试中取得了高分。此外,Kimi K2似乎还颇具写作天赋,在一些专业测试中名列前茅。

目前,包括硅谷的开源社区等在内的AI开发者都在热议Kimi K2。官方数据显示,其总参数规模达到了万亿级别(1T),不过由于采用混合专家架构,每次任务仅动态激活320亿参数,只需调用模型中相关模块,从而有助于控制所需算力。

与DeepSeek系列模型类似,Kimi K2采用开源协议发布,允许研究人员免费下载并进行本地部署与二次开发。同时,该模型支持通过应用程序接口调用,其定价显著低于“克劳德4”等主流闭源模型。

美国艾伦人工智能研究所机器学习研究员纳坦·兰伯特说:“今年早些时候发布的DeepSeek-R1更像是AI发展轨迹中的前传,而非昙花一现。Kimi K2是全球最佳的全新开源模型。”

原标题:《《自然》网站:中国AI模型“又一个DeepSeek时刻”》


“《自然》网站:中国AI模型“又一个DeepSeek时刻”” 的相关文章

DeepSeek等大模型在证券行业应用及影响研究

DeepSeek等大模型在证券行业应用及影响研究

李宁 谢琪 王钟菱1华福证券有限责任公司一、前言在国家战略和行业监管鼓励下,证券行业已在多个业务场景运用大模型技术,但受制于大模型高昂的应用成本、对英伟达算力GPU和研发生态的依赖、算法结果不可解释和...

「DeepSeek智能办公实战训练营」学员招募令——4大核心场景 • 效率翻倍

「DeepSeek智能办公实战训练营」学员招募令——4大核心场景 • 效率翻倍

培训时间2025年4月12日-13日(共2天)2培训地点浙江邮电职业技术学院(滨海校区)3招募对象企事业单位管理者、办公室/宣传/数据部门骨干(个人可自荐,单位可组队)!一、培训主题以DeepSeek...

怎么修改 DeepSeek 的返回值的数据类型?

怎么修改 DeepSeek 的返回值的数据类型?

怎么修改 DeepSeek 的返回值的数据类型?要修改 DeepSeek 的返回值数据类型,可以通过调整模型的输出配置或使用适当的数据处理方法来实现。以下是一些可能的步骤:明确输出要求:在发送请求时,...

PPIO 上线 DeepSeek-Prover-V2-671B

PPIO 上线 DeepSeek-Prover-V2-671B

4月30日,DeepSeek 在 Hugging Face 开源了 DeepSeek-Prover-V2-671B 新模型。作为一站式 AIGC 云服务平台,PPIO派欧云在第一时间上线了 DeepS...

DeepSeek开源Prover-V2强推理模型,网友:奥数从没这么简单过

DeepSeek开源Prover-V2强推理模型,网友:奥数从没这么简单过

DeepSeek R2 的前奏?五一劳动节到了,DeepSeek 的新消息可没停下来。前些天到处都在流传着 DeepSeek-R2 即将发布的传言,DeepSeek 确实有新动作,不过大家没等来 R2...

暴击GPT-4.5,DeepSeek-V3-0324官方报告出炉!系统提示、最佳温度全放出

暴击GPT-4.5,DeepSeek-V3-0324官方报告出炉!系统提示、最佳温度全放出

【新智元导读】只有660B参数的开源模型,在数学和编程性能上击败了GPT-4.5和Claude 3.7。DeepSeek-V3-0324新版本的发布让全球网友为之疯狂,推理能力提升近20%,模型权重已...