当前位置：首页 > DeepSeek技术交流 > 正文内容

新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练

8个月前 (03-26)DeepSeek技术交流445

明敏发自凹非寺

量子位 | 公众号 QbitAI

刚刚，DeepSeek官方发布DeepSeek-V3模型更新技术报告。

V3新版本在数学、代码类相关评测集成绩超过GPT-4.5！

而且这只是通过改进后训练方法实现。

DeepSeek-V3-0324和之前的DeepSeek-V3使用同样的base模型。

打破了之前传言该版本base模型是R2的传言。

新版本参数量约为660B，与此前网传的685B有所出入。

开源版本上下文长度为128K（网页端、App和API提供 64K 上下文）。

私有化部署时只需要更新checkpoint和tokenizer_config.json（tool calls相关变动）。

目前，想要体验这一版本模型，只需用户登录官方网页、APP、小程序进入对话界面后，关闭深度思考即可体验。API 接口和使用方式保持不变。

官方建议，此后非复杂推理任务使用V3新版本更好。

此外，官方还进一步展示了新版本在各个维度的能力。

前端开发

生成代码可用性更高，视觉效果也更好。

中文写作

相较于R1版有进一步优化，特别提升了中长篇的内容质量。

比如写一篇关于苏轼生平的散文：

中文搜索

联网情况下，V3新版本的搜索输出内容也更详实准确、排版更清晰美观。

现在写一份3000字的市场报告也是so easy（上下滑动查看完整内容）：

此外，V3新版本在工具调用、角色扮演、问答闲聊等方面也进一步提升。

今天白天不少网友也上手实测了诸多能力，比如做个小游戏：

该版本模型采用宽松的MIT开源协议。

且可直接部署在M3 Ultra的Mac Studio上。

这意味着大模型开发应用的门槛更进一步降低。

话不多说，趁着深夜，还没睡的赶紧去体验最新版吧~

原标题：《新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练》

标签: DeepSeek 人工智能数据分析应用场景

返回列表

上一篇：DeepSeek V3再次震撼硅谷，中美AI差距突然缩至3个月！

下一篇：DeepSeek-V3升级：评测达75.9%正确率，代码生成提速40%

“新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练” 的相关文章

伊春市委网信办举办全市网信系统DeepSeek人工智能专题培训会

中新网黑龙江新闻3月22日电(刘璐)2025年3月21日，伊春市委网信办举办全市网信系统DeepSeek人工智能专题培训会。市委网信办、市网络安全应急指挥中心全体工作人员，各县(市)区委网信办全体干部...

辽宁省疾控中心接入DeepSeek 提高疾控精准性时效性

近日，省疾病预防控制中心正式宣布接入DeepSeek，成为东北地区首家引入AI技术全面赋能公共卫生管理的省级疾控机构，为我省疾病预防控制战线和智慧疾控建设赋予全新内驱力。目前，省疾病预防控制中心已初步...

DeepSeek概念股普遍加大绿电使用并升级算力专家提醒注意碳排放数据真实性

“因为自己淋过雨，所以想为他人撑一把伞。”李连才是科大讯飞（SZ002230，股价47.86元，市值1106亿元）程序员，也是一位在黑暗中摸索的视障者。在2025年4月讯飞星火智能体挑战赛中，他为视障...

DeepSeek＋水利治水迎“智”变

今年以来，随着以DeepSeek为代表的人工智能技术向垂直领域加速渗透，水利行业也迎来新一轮技术应用变革。目前，全省水利系统正积极开展“DeepSeek+水利”的相关应用，除了已经上线“DS都江堰”智...

2025年DeepSeek一体机：热潮下的机遇与挑战

2025年DeepSeek一体机：热潮下的机遇与挑战2025年伊始，DeepSeek大模型引领的一体机热潮如狂风般席卷中国AI市场。这款一体机凭借“开箱即用”的便捷特性以及超低的准入门槛，迅速吸引了众...

DeepSeek单日处理量等于镇江全市公务员10年工作量，为何有争议？

2月19日，江苏镇江举行新闻发布会，正式宣布国产大模型DeepSeek在镇江进行本地化部署。镇江市数据局党组书记、局长周飞在会上表示，“镇江已经建成600台国产算力服务器集群，单日数据处理能力相当于全...

新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练

“新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练” 的相关文章

伊春市委网信办举办全市网信系统DeepSeek人工智能专题培训会

辽宁省疾控中心接入DeepSeek 提高疾控精准性时效性

DeepSeek概念股普遍加大绿电使用并升级算力专家提醒注意碳排放数据真实性

DeepSeek＋水利治水迎“智”变

2025年DeepSeek一体机：热潮下的机遇与挑战

DeepSeek单日处理量等于镇江全市公务员10年工作量，为何有争议？

温馨提示：
DeepSeek爱好者为非盈利站点，所有内容均来自网络整理，不保证内容的真实性。

Powered By Z-BlogPHP. Theme by TOYEAN.

新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练

“新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练” 的相关文章

伊春市委网信办举办全市网信系统DeepSeek人工智能专题培训会

辽宁省疾控中心接入DeepSeek 提高疾控精准性时效性

DeepSeek概念股普遍加大绿电使用并升级算力 专家提醒注意碳排放数据真实性

DeepSeek＋水利 治水迎“智”变

2025年DeepSeek一体机：热潮下的机遇与挑战

DeepSeek单日处理量等于镇江全市公务员10年工作量，为何有争议？

Powered By Z-BlogPHP. Theme by TOYEAN.

DeepSeek概念股普遍加大绿电使用并升级算力专家提醒注意碳排放数据真实性

DeepSeek＋水利治水迎“智”变