当前位置:首页 > Deepseek最新资讯 > 正文内容

基于华为昇腾训练 性能不输英伟达!自家模型爆料:DeepSeek-R2本月要发布

2个月前 (08-12)Deepseek最新资讯217

  快科技8月12日消息,ChatGPT-5已经发布,那么国产大模型DeepSeek大版本更新也就不远了。

  从网友向DeepSeek提出的问题看,该模型给出的答案是,DeepSeek-R2预计将在2025年8月15日至8月30日之间发布。

  在这样的背景下,国产算力链多家公司股价出现了大涨,比如寒武纪直接今天20cm涨停,股价创历史新高,市值突破3550亿元。

  按照之前的说法,DeepSeek-R2大模型将会采用一种更先进的混合专家模型(MoE),其结合了更加智能的门控网络层(Gating Network)以优化高负载推理任务的性能。

  有分析师预计,DeepSeek-R2的定价可能显著低于OpenAI同类产品,预示着其可能颠覆现有AI服务的定价模式。

  此外,还有相关消息显示,DeepSeek-R2预计比GPT-4成本下降97%;并且是在昇腾卡上做的训练,主打一个全方位全产业链的自主可控。

  据相关人士透露的情况,DeepSeek-R2的总参数量可能会达到1.2万亿,比DeepSeek-R1的6710亿参数增加大约一倍。

  据华为实验室统计,这个性能相当于英伟达上一代A100训练集群的91%左右deepseek。至于这些是不是真实的,还有待观察,但看起来确实更强大、更自主了。原文出处:基于华为昇腾训练 性能不输英伟达!自家模型爆料:DeepSeek-R2本月要发布,感谢原作者,侵权必删!

标签: deepseek

“基于华为昇腾训练 性能不输英伟达!自家模型爆料:DeepSeek-R2本月要发布” 的相关文章

朱啸虎称DeepSeek影响力被低估,开源AI生态对人类至关重要

朱啸虎称DeepSeek影响力被低估,开源AI生态对人类至关重要

  【#朱啸虎称大家低估了DeepSeek影响力#】由硅星人与北京中关村科学城创新发展有限公司、北京中关村创业大街科技服务有限公司联合发起的“AI 创造者嘉年华”上,金沙江创投主管合伙人朱...

华泰证券:DeepSeek-V3.1发布,国产算力链迎来高景气

华泰证券:DeepSeek-V3.1发布,国产算力链迎来高景气

  研报表示,Deepseek官方发布DeepSeek-V3.1版本,采用UE8M0 FP8精度参数,能效高、动态范围大、能避免信息损失。该精度参数是针对即将发布的下一代国产芯片设计,国产...

招生简章丨关于举办“Deepseek驱动下的行政事业单位政府采购与资产管理实践”

招生简章丨关于举办“Deepseek驱动下的行政事业单位政府采购与资产管理实践”

  为帮助各单位人员深入学习政府采购及其在国有资产管理的应用,提升资产管理人员的业务水平和管理能力,规范采购流程,有针对性地解决政府采购及招投标业务存在的突出问题,以及人工智能大模型Dee...

DeepSeek短暂上线V3.2,官方:线上模型已更新

DeepSeek短暂上线V3.2,官方:线上模型已更新

  与此同时,DeepSeek官方表示,其线上模型版本已完成更新deepseek,并邀请用户进行测试和反馈。(袁宁)原文出处:DeepSeek短暂上线V3.2,官方:线上模型已更新,感谢原...

429元 诺基亚宣布HMD 3210巴萨版上市:巴萨Logo深度定制 支持Dee

429元 诺基亚宣布HMD 3210巴萨版上市:巴萨Logo深度定制 支持Dee

  HMD 3210AI巴萨版搭载Deepseek的AI助手,可通过AI助手询问职场、生活、学习等方面问题。   HMD 3210AI巴萨版采用2.4英寸IPS屏,配备2...

DeepSeek,重磅发布!

DeepSeek,重磅发布!

  更强的 Agent 能力:通过 Post-Training 优化,新模型在工具使用与智能体任务中的表现有较大提升。   目前,官方App与网页端模型已同步升级为Dee...