当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek发布新版本模型:优化推理效率,API降价超50%

  值得注意的是,此前有不少科技博主发现,DeepSeek-V3.2新模型已上传至其HuggingFace官方页面,随后被删除,此后DeepSeek正式公告新版本的推出。

  据DeepSeek介绍,作为迈向新一代架构的中间步骤,V3.2-Exp在V3.1-Terminus的基础上引入DeepSeek Sparse Attention(一种稀疏注意力机制),针对长文本的训练和推理效率进行探索性优化和验证。目前,官方App、网页端、小程序均已同步更新为DeepSeek-V3.2-Exp,同时API大幅度降价。

  据了解,DeepSeek Sparse Attention(DSA)首次实现细粒度稀疏注意力机制,在几乎不影响模型输出效果的前提下,实现长文本训练和推理效率的大幅提升。为严谨评估引入稀疏注意力带来的影响,把DeepSeek-V3.2-Exp的训练设置与V3.1-Terminus进行严格的对齐。在各领域的公开评测集上,DeepSeek-V3.2-Exp的表现与V3.1-Terminus基本持平。

  在新模型的研究过程中,需要设计和实现很多新的GPU算子,使用高级语言TileLang进行快速原型开发,以支持更深入的探索。在最后阶段,以TileLang作为精度基线,逐步使用底层语言实现更高效的版本。此次开源的主要算子包含TileLang与 CUDA两种版本。

  DeepSeek表示,得益于新模型服务成本的大幅降低,官方API价格也相应下调,开发者调用DeepSeek API的成本将降低50%以上。从价格来看,输入缓存命中从0.5元降至0.2元/百万tokens,缓存未命中从4元降至2元/百万tokens,输出由12元降至3元/百万tokens。

  除了DeepSeek,国内另一大模型厂商智谱的新一代旗舰模型GLM-4.6也即将发布,目前deepseek,在Z.ai官网可以看到,GLM-4.5标识为上一代旗舰模型。

  此前9月18日,梁文锋带着DeepSeek-R1的研究,登上最新一期国际顶级期刊《自然》(Nature)封面。

  《自然》杂志指出,如此总结DeepSeek-R1带来的进步:如果训练出的大模型能够规划解决问题所需的步骤,那么它们往往能够更好地解决问题。这种“推理”与人类处理更复杂问题的方式类似,但这对人工智能有极大挑战,需要人工干预来添加标签和注释。

  DeepSeek的研究人员揭示了他们如何能够在极少的人工输入下训练一个模型,并使其进行推理。DeepSeek-R1模型采用强化学习进行训练。在这种学习中,模型正确解答数学问题时会获得高分奖励,答错则会受到惩罚。原文出处:DeepSeek发布新版本模型:优化推理效率,API降价超50%,感谢原作者,侵权必删!

标签: deepseek

“DeepSeek发布新版本模型:优化推理效率,API降价超50%” 的相关文章

基于华为昇腾训练 性能不输英伟达!自家模型爆料:DeepSeek-R2本月要发布

基于华为昇腾训练 性能不输英伟达!自家模型爆料:DeepSeek-R2本月要发布

  快科技8月12日消息,ChatGPT-5已经发布,那么国产大模型DeepSeek大版本更新也就不远了。   从网友向DeepSeek提出的问题看,该模型给出的答案是,...

每日互动股价上涨8.49% 市场关注DeepSeek-R2发布时间传闻

每日互动股价上涨8.49% 市场关注DeepSeek-R2发布时间传闻

  截至2025年8月12日15时28分,每日互动股价报40.88元,较前一交易日上涨3.20元,涨幅8.49%。盘中最高触及42.48元,最低下探37.13元,成交额40.21亿元,换手...

今起实施!AI生成内容必须带“身份证”,腾讯、抖音、快手、B站、DeepSeek

今起实施!AI生成内容必须带“身份证”,腾讯、抖音、快手、B站、DeepSeek

  带货视频中的明星配音、短视频里突然出现的名人,可能并非本人,而是AI生成——从9月1日起,它们必须亮明身份。   9月1日,由国家互联网信息办公室、工业和信息化部等部...

用户增速最快的亿级APP TOP20出炉:DeepSeek排第一

用户增速最快的亿级APP TOP20出炉:DeepSeek排第一

  快科技7月29日消息,今天,Quest Mobile揭晓了2025年6月活跃用户规模1亿以上且同比增长率领先的前20款APP。   在这份榜单中,DeepSeek以1...

H20停产,Deepseek力挺国产AI,AIETF涨超4%

H20停产,Deepseek力挺国产AI,AIETF涨超4%

  8月25日,市场集体高开,芯片板块领跑全市,$科创芯片ETF富国(588810)涨超2%,$AIETF富国(589380)涨近4%。成分股航天宏图、云天励飞-U涨超15%,寒武纪-U涨...

移动AI融合创新发展论坛在京举办,“移动AI产业推进方阵”正式成立

移动AI融合创新发展论坛在京举办,“移动AI产业推进方阵”正式成立

  9月25日,移动AI融合创新发展论坛在国家会议中心隆重召开,在工业和信息化部的指导下,依托于IMT-2020(5G)推进组和IMT-2030(6G)推进组,由中国信息通信研究院牵头,联...