当前位置:首页 > DeepSeek技术交流 > 正文内容

DeepSeek V3升级版发布:编程数学能力接近Claude 3.7

4个月前 (03-25)DeepSeek技术交流326

DeepSeek于24日夜间发布V3模型小版本升级,新版本DeepSeek-V3-0324在模型参数上达到685B,并采用MIT许可证,为用户带来全新体验。该版本重点提升了数学和编程能力,性能接近Claude 3.7 Sonnet,且对用户免费开放使用。

模型架构全面升级

DeepSeek-V3作为专家混合巨头模型,原始参数为671B,每个Token可激活370亿个参数。新版本DeepSeek-V3-0324的模型参数提升至685B,采用多头潜在注意力和DeepSeek MoE技术支持。知识截止日期从2023年12月延长至2024年7月,优化了Function call功能,解决了此前版本的函数调用问题。

编程能力显著提升

在前端编程领域,DeepSeek V3-0324展现出惊人实力。测试显示,其能在3分钟内完成750行电商网站代码,包含动态产品卡片悬停效果和手机端响应式布局等功能。自2024年6月以来,业界普遍认为仅Claude 3.5能够生成优质前端代码,而此次DeepSeek的升级版本终于为Anthropic带来了强劲竞争对手。在数学能力方面,V3-0324也表现出色,成功解答了此前大模型普遍解答错误的数学题目。

开源协议引领行业变革

DeepSeek V3-0324采用MIT许可证,允许用户出于任何目的使用、修改和分发模型,包括商业用途。这一决策获得业内广泛关注,Perplexity CEO阿拉文德认为,DeepSeek的开源策略具有革命性意义。该模型不仅能在AWS和Azure上以极低成本部署,仅需支付服务器费用,还为创业企业提供了可负担的AI解决方案。这种开源模式可能影响未来AI巨头的融资格局,推动行业向更开放、更透明的方向发展。

本文源自:金融界


“DeepSeek V3升级版发布:编程数学能力接近Claude 3.7” 的相关文章

薛少华:DeepSeek改变了我们什么?

薛少华:DeepSeek改变了我们什么?

提要:当前技术环境的剧烈变革给人类适应数字智能时代不断施加认知压力,特别是“银发群体”可能成为“数字难民”的主要成员,会对当下流行和即将到来的智慧家居、具身机器人和动态数智环境交互产生极大的不适应感,...

桦川:“调解+DeepSeek”开启基层社会治理智慧新篇

桦川:“调解+DeepSeek”开启基层社会治理智慧新篇

在基层社会治理的大棋盘上,矛盾纠纷调解是至关重要的一子。近日,桦川县综治中心创新举措,将矛盾纠纷调解工作与DeepSeek功能深度融合,成功化解多起矛盾纠纷,为基层治理难题提供了智慧解决方案,开启了基...

DeepSeek一体机有哪些功能?DeepSeek一体机配置要求价格

DeepSeek一体机有哪些功能?DeepSeek一体机配置要求价格

最近,科技圈有个“新晋顶流”横空出世,名字叫DeepSeek一体机。它火到什么程度?朋友圈不断刷屏,有人调侃:“没抢到DeepSeek一体机,都不好意思说自己懂科技。”一款设备,凭什么能火出圈?Dee...

中创股份:公司已完成DeepSeek、通义千问等私有化大模型的部署工作

中创股份:公司已完成DeepSeek、通义千问等私有化大模型的部署工作

金融研究中心05月27日讯,有投资者向中创股份提问, 董秘您好!请问公司如何利用与华为等企业的深度合作关系,进一步提升公司中间件对AI应用场景的支撑能力,推动AI产业发展?  公司回答表示,尊敬的投资...

中信银行谷凌云:本月在部分业务中布局了DeepSeek模型

中信银行谷凌云:本月在部分业务中布局了DeepSeek模型

新京报贝壳财经讯(记者姜樊)3月27日,中信银行副行长谷凌云在2024年业绩发布会上表示,在DeepSeek R1发布后,中信银行立即组织了对应的分析和跟进,本月已在部分业务场景中部署了DeepSee...

贵州高速集团全面接入DeepSeek大模型

贵州高速集团全面接入DeepSeek大模型

近日,贵州高速集团接入DeepSeek人工智能大模型,通过“自主可控+开源协同”双引擎驱动,完成高速集团自研“贵高智通”大模型的开发,实现数智化转型的阶段性突破,推动智慧交通、物流规划及数据应用三大提...