当前位置:首页 > Deepseek最新资讯 > 正文内容

清华团队推出“安全增强版DeepSeek”大语言模型RealSafe-R1

9个月前 (02-24)Deepseek最新资讯485

人民网北京2月24日电 (记者赵竹青)2月23日,清华大学计算机系相关研究团队宣布推出大语言模型RealSafe-R1。该模型基于DeepSeek R1进行深度优化与后训练,在确保性能稳定的基础上,显著提升了安全性,为开源大模型的安全发展与风险治理提供了创新性解决方案。

近日来,国产开源大模型DeepSeek在自然语言处理和多任务推理方面展现了强大的技术实力,但在面对越狱攻击等安全性挑战时仍存在一定局限性。为此,清华团队提出了基于模型自我提升的安全对齐方式,将安全对齐与内省推理相结合,使大语言模型能够通过具有安全意识的思维链分析来检查潜在风险,实现基础模型自身能力的自主进化。

基于该方法,团队对DeepSeek-R1系列模型进行后训练,正式推出RealSafe-R1系列大模型。实验数据表明,RealSafe-R1安全性提升显著,在多个基准测试中有效增强了对各种越狱攻击的抵抗力,并减轻了安全与性能之间的“跷跷板”现象。

据悉,RealSafe-R1各尺寸模型及数据集将于近期向全球开发者开源。


“清华团队推出“安全增强版DeepSeek”大语言模型RealSafe-R1” 的相关文章

九江市教育局举办“DeepSeek等人工智能技术赋能教育图景”专题讲座

九江市教育局举办“DeepSeek等人工智能技术赋能教育图景”专题讲座

为积极响应国家教育数字化战略行动,进一步推动人工智能技术与教育教学的深度融合,提升我市教育现代化水平,市教育局精心筹备并举办了 “DeepSeek等人工智能技术赋能教育图景” 专题讲座。市教育局在家班...

四川:Deepseek等技术快速发展 带动算力相关产品新需求增加

四川:Deepseek等技术快速发展 带动算力相关产品新需求增加

4月17日,四川省政府新闻办公室举行新闻发布会,四川省统计局副局长、新闻发言人杨治刚表示,Deepseek等人工智能技术快速发展带动算力相关产品新需求增加,叠加消费品以旧换新等政策加力扩围。今年一季度...

快手搜索已全面接入DeepSeek R1

快手搜索已全面接入DeepSeek R1

3月21日,华尔街见闻获悉,快手搜索已全面接入DeepSeek R1的大模型能力,旨在优化搜索效果与用户体验,并进一步提升用户活跃度,未来也会持续探索智能搜索场景的商业化变现能力。(全天候科技)...

DeepSeek R1模型已完成小版本试升级

DeepSeek R1模型已完成小版本试升级

每经快讯,5月28日,DeepSeek官方宣布DeepSeek R1模型已完成小版本试升级,欢迎前往官方网页、APP、小程序测试(打开深度思考),API 接口和使用方式保持不变。每日经济新闻...

英伟达新GPU再王炸,也得靠蹭DeepSeek卖卡

英伟达新GPU再王炸,也得靠蹭DeepSeek卖卡

一身皮衣黄仁勋,GTC 2025上意气风发。虽然最近英伟达的股票跌得比较狠,甚至来到了10年来的最低点,但这不影响老黄,对最新的GPU们信心满满。时间回拨到2月初,DeepSeek的发布在AI领域掀起...

「远东3.0新时代」远东宏信完成DeepSeek本地化部署,开启智能化应用之路

「远东3.0新时代」远东宏信完成DeepSeek本地化部署,开启智能化应用之路

人工智能正以前所未有的深度和广度重塑全球经济格局,成为驱动商业升级的核心引擎。在科技与金融深度融合的今天,远东宏信以战略眼光拥抱变革,率先完成DeepSeek大模型的本地化部署,标志着公司在智能化转型...