当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek新消息:DeepSeek发布模型更新——DeepSeek-V3-0324

3个月前 (03-25)Deepseek最新资讯251

3月24日晚,DeepSeek发布了模型更新——DeepSeek-V3-0324。本次更新为DeepSeek V3模型的版本更新,并非市场此前一直期待的DeepSeek-V4或R2。目前,其开源版本已上线Hugging Face。据悉,其开源版本模型体积为6850亿参数。

同日,DeepSeek在其官方交流群宣布称,DeepSeek V3模型已完成小版本升级,欢迎前往官方网页、App、小程序试用体验(关闭深度思考),API接口和使用方式保持不变。


从网友反馈的实测效果来看,V3编码能力已经接近 Claude3.7,数学能力也有提升,能像推理模型一样解题。

此前于2024年12月发布的DeepSeek-V3模型曾以“557.6万美金比肩Claude 3.5效果”的高性价比著称,其多项评测成绩超越了Qwen2.5-72B和Llama-3.1-405B等其他开源模型,并在性能上和世界顶尖的闭源模型GPT-4o以及Claude-3.5-Sonnet不分伯仲。但截至目前,还没有任何关于新版 DeepSeek-V3的能力基准测试榜单出现。


其后,DeepSeek于2025年1月发布了性能比肩OpenAI o1正式版的DeepSeek-R1模型,该模型在后训练阶段大规模使用了强化学习技术,在仅有极少标注数据的情况下,极大提升了模型推理能力。

2025年2月25日,市场上也曾出现DeepSeek-R2模型的发布时间或将提前的消息。路透社称,DeepSeek正在加快推出DeepSeek-R1模型的后续产品DeepSeek-R2。据悉,DeepSeek-R2原计划在5月初发布,但公司现在希望尽早推出。

综合/上海证券报、第一财经微信

来源:经济日报


“DeepSeek新消息:DeepSeek发布模型更新——DeepSeek-V3-0324” 的相关文章

deepseek能直接生成ppt吗?

deepseek能直接生成ppt吗?

deepseek能直接生成ppt吗?目前DeepSeek作为文本生成模型,无法直接生成PPT文件,但可以通过以下方式辅助制作专业演示文稿:一、文案生成技巧标题优化复制代码“生成10个科技风PPT标题,...

国家广电总局广科院、当虹科技等单位发起成立DeepSeek传媒行业应用创新联盟

国家广电总局广科院、当虹科技等单位发起成立DeepSeek传媒行业应用创新联盟

证券时报e公司讯,2月11日举办的DeepSeek大模型传媒行业应用研讨会上,当虹科技与国家广电总局广科院等多家单位联合发起成立DeepSeek传媒行业应用创新联盟,共同迈进“DeepSeek+传媒应...

DeepSeek为何引发全民心态变化?刘俏:科技革命催生出新节点产业

DeepSeek为何引发全民心态变化?刘俏:科技革命催生出新节点产业

 正值2025博鳌亚洲论坛召开期间,3月26日,新浪财经、北京大学光华管理学院在博鳌举办“2025博鳌新浪财经之夜”活动,北京大学光华管理学院院长、教授刘俏发表主题为《从国际到国内预测经济走势,中国如...

DeepSeek助力贵阳贵安营商环境再上新台阶

DeepSeek助力贵阳贵安营商环境再上新台阶

3月7日上午,贵阳贵安DeepSeek部署应用新闻发布会举行。贵阳市投资促进局副局长秦军介绍了DeepSeek赋能贵阳贵安招商引资、完善配套服务,优化营商环境的做法和取得成效。贵阳市数智化推进招商引资...

不联网也能用AI!武汉企业推出DeepSeek本地部署主机

不联网也能用AI!武汉企业推出DeepSeek本地部署主机

长江日报大武汉客户端2月20日讯(记者郝天娇)春节期间,我国国产开源大模型深度求索(DeepSeek)在全球范围“火出圈”。上周五,黄陂区企业武汉攀升鼎承科技有限公司(以下简称攀升科技)正式推出搭载本...

华为鸿蒙电脑接入DeepSeek:生产力更强

华为鸿蒙电脑接入DeepSeek:生产力更强

驱动之家5月10日消息,在今日举办的星耀智能手表技术与生态发布会上,星耀智能手表正式闪耀登场。据介绍,星耀智能手表搭载了StarOS 3.0,采用星耀自研内核,带来精准、便捷、健康、时尚、互联的体验。...