当前位置:首页 > Deepseek应用场景 > 正文内容

OpenAI罕见宣布将开源推理模型,DeepSeek给逼的

4周前 (04-01)Deepseek应用场景115

就在刚刚,OpenAI CEO Sam Altman正式宣布,将在未来几个月内推出一款具备推理能力的强大开放权重语言模型,并期待与开发者共同探索如何最大化其潜力。


据Altman透露,这是自GPT-2以来OpenAI首次计划发布开放权重语言模型。


他坦言,虽然这一想法已酝酿许久,但此前其他优先事项占据了主导地位。如今,发布这款模型的时机变得尤为重要。



作为参考,开放权重(open weight)是指将AI模型(尤其是神经网络)的训练参数(即权重)公开,供公众使用、检查或进一步开发。


用户可以在这些权重的基础上进行修改,并将修改后的权重重新分发。


虽然开放权重不能完全等同于开源,是一种介于完全闭源和完全开源之间的折中方案,但它是开源理念在AI领域的一种延伸和部分实现,包括此前宣称开源的DeepSeek V3/R1同样只开放了权重。


在正式发布前,OpenAI将依据其“准备框架”对模型进行评估,确保其安全性与可靠性。


考虑到模型发布后可能被修改,团队还将开展额外测试与优化工作。


为进一步完善开发流程,OpenAI计划举办一系列开发者活动,以收集反馈并展示早期原型。首场活动将于数周后在旧金山启动,随后在欧洲和亚太地区陆续展开。


有兴趣参与的开发者可通过链接报名:
https://openai.com/open-model-feedback



OpenAI研究员约翰内斯·海德克(Johannes Heidecke)对此补充道:


“安全性是我们开发开放权重模型的核心。从预训练到发布,我们都会遵循严格的准备框架,确保不会推出可能引发灾难性风险的模型。尽管开放模型面临独特挑战,我们对此充满信心。”


目前,Altman的评论区已经乱成一锅粥了。


网友呼声最高的模型是OpenAI o1 mini,全球最大AI开源社区Hugging Face CEO Clément Delangue也现身评论区。



谈到开源,自然绕不开DeepSeek。R1和R2的身影也充斥着整个评论区。




网友是懂Sam Altman的。毕竟GPT-5也说是“未来几个月”发布,但至今未见踪影。



Altman此前发文透露,得益于GPT-4o的多模态图像生成功能,OpenAI在过去五天内新增了100万用户。



并且由于大量用户的涌入,导致OpenAI的GPU被“融化了”,等模型开放后只能说形势易转。



值得一提的是,Altman上个月曾与硅谷知名分析师Ben Thompson进行了一场深度对谈,其中也有谈到包括开源模型以及和DeepSeek的竞争。


他当时表示:


我认为DeepSeek确实是个很棒的团队,也做出了很优秀的模型,但他们真正走红的原因,并不完全是模型本身的能力。


这对我们来说是一个教训,那就是当我们隐藏一个功能时(思维链),我们给其他人留下了获得病毒式传播的机会。这是一个很好的警醒。它也让我重新思考我们在免费层中提供的内容,GPT-5将可以免费使用。


在今天的发文中,他表示“我们已经考虑这个问题很长时间了,但其他优先事项曾经占据了更高的优先级,现在感觉发布它变得非常重要。”


显然,这位曾罕见承认OpenAI封闭策略站在“历史的错误一方”的CEO已经深刻认识到开源的战略意义。


在接下来的几个月内,无论是Llama 4,还是DeepSeek R2都将成为击垮OpenAI声誉的重要一击,而此次宣布开源,或许正是OpenAI精心准备的一招反击。


“OpenAI罕见宣布将开源推理模型,DeepSeek给逼的” 的相关文章

DeepSeek大消息!高管发生变更

DeepSeek大消息!高管发生变更

企查查APP显示,近日,DeepSeek关联公司杭州深度求索人工智能基础技术研究有限公司发生工商变更,裴湉由执行董事兼总经理改任经理、董事,新增王贤祖为财务负责人,同时经营范围新增互联网信息服务。该公...

DeepSeek专题培训会助力民营企业把握AI技术革新机遇

DeepSeek专题培训会助力民营企业把握AI技术革新机遇

为深入贯彻落实党的二十届三中全会精神,促进数字经济与实体经济深度融合,助力民营企业把握人工智能技术革新机遇,近日,怀来县工商联举办以“把握AI浪潮,赋能企业创新,共启智慧未来”为主题的DeepSeek...

央国企春招开启“抢人”模式 “DeepSeek”类人才受青睐

央国企春招开启“抢人”模式 “DeepSeek”类人才受青睐

3月以来春季招聘陆续开始,据不完全统计,今年已经有超过150家央国企及其下属子公司组织开展了春季招聘活动,目前各地也举办了多场国企专项招聘会。“央企能够吸引到DeepSeek团队这类级别的人才。”AP...

提升DeepSeek认知能力!贵阳大数据科创城开展相关培训

提升DeepSeek认知能力!贵阳大数据科创城开展相关培训

3月12日,贵阳大数据科创城组织开展DeepSeek人工智能大模型专题培训,邀请相关专家现场培训,进一步提升干部职工数字化素养和业务能力。培训会现场。“大模型的‘大’通常体现在参数数量庞大、训练数据量...

DeepSeek引爆AI应用

DeepSeek引爆AI应用

激活AI产业链 DeepSeek持续扩大生态圈湖南日报2025-02-09 08:52● 本报记者 杨洁DeepSeek(深度求索)成为继ChatGPT之后的又一现象级AI产品。据国内AI产品榜统计数...

deepseek怎样做数学题,deepseek如何解数学题?

deepseek怎样做数学题,deepseek如何解数学题?

DeepSeek可以通过其强大的自然语言处理(NLP)和机器学习能力来帮助解答数学题。以下是DeepSeek解答数学题的一般步骤:一、输入题目或数学问题用户可以通过DeepSeek的网页端或APP端,...