当前位置:首页 > Deepseek最新资讯 > 正文内容

清华团队推出“安全增强版DeepSeek”

2个月前 (02-24)Deepseek最新资讯131

人民网北京2月24日电 (记者赵竹青)2月23日,清华大学计算机系相关研究团队宣布推出大语言模型RealSafe-R1。该模型基于DeepSeek R1进行深度优化与后训练,在确保性能稳定的基础上,显著提升了安全性,为开源大模型的安全发展与风险治理提供了创新性解决方案。

近日来,国产开源大模型DeepSeek在自然语言处理和多任务推理方面展现了强大的技术实力,但在面对越狱攻击等安全性挑战时仍存在一定局限性。为此,清华团队提出了基于模型自我提升的安全对齐方式,将安全对齐与内省推理相结合,使大语言模型能够通过具有安全意识的思维链分析来检查潜在风险,实现基础模型自身能力的自主进化。

基于该方法,团队对DeepSeek-R1系列模型进行后训练,正式推出RealSafe-R1系列大模型。实验数据表明,RealSafe-R1安全性提升显著,在多个基准测试中有效增强了对各种越狱攻击的抵抗力,并减轻了安全与性能之间的“跷跷板”现象。

据悉,RealSafe-R1各尺寸模型及数据集将于近期向全球开发者开源。


“清华团队推出“安全增强版DeepSeek”” 的相关文章

DeepSeek新专利“一种广度数据采集的方法及其系统”公布,可减少数据采集时网络资源消耗

DeepSeek新专利“一种广度数据采集的方法及其系统”公布,可减少数据采集时网络资源消耗

国家知识产权局官网显示,4月1日,DeepSeek关联公司杭州深度求索人工智能基础技术研究有限公司申请的“一种广度数据采集的方法及其系统”专利公布。摘要显示,本发明涉及数据采集领域,尤其涉及一种广度数...

全干货实操!DeepSeek-R1终极攻略:99%的人不知道的高效玩法大公开!

全干货实操!DeepSeek-R1终极攻略:99%的人不知道的高效玩法大公开!

最近,号称“中国版GPT-4o”的DeepSeek-R1火爆全网!朋友圈、科技媒体、甚至程序员社群都在刷屏讨论。但很多小伙伴反馈:“明明功能超强,为什么我用起来总翻车?”  答案很简单: 你...

仙乐健康:接入DeepSeek大模型 布局智能配方设计

仙乐健康:接入DeepSeek大模型 布局智能配方设计

仙乐健康(300791)近日宣布已完成DeepSeek大模型的战略接入,仙乐健康旨在通过接入DeepSeek打造独有的智能配方设计系统。...

董明珠:将基于 DeepSeek 等打造格力智能家居垂类大模型

董明珠:将基于 DeepSeek 等打造格力智能家居垂类大模型

IT之家 3 月 10 日消息,据证券日报昨日晚间报道,格力董明珠透露:“格力电器已成功将自有的多模型框架与 DeepSeek R1 满血版大模型深度融合。”“例如,这一合作成果已经体现在格力电器的语...

DeepSeek助力贵阳贵安营商环境再上新台阶

DeepSeek助力贵阳贵安营商环境再上新台阶

3月7日上午,贵阳贵安DeepSeek部署应用新闻发布会举行。贵阳市投资促进局副局长秦军介绍了DeepSeek赋能贵阳贵安招商引资、完善配套服务,优化营商环境的做法和取得成效。贵阳市数智化推进招商引资...

机构调研券商!DeepSeek部署成为热点问题

机构调研券商!DeepSeek部署成为热点问题

券商股近期异动频频。券商中国记者注意到,对于上市券商的关注,除了一些合并传闻的扰动,机构投资者对长江证券、长城证券等上市券商以及券商概念股——指南针等,也展开了新一轮调研,券商布局DeepSeek的进...