当前位置:首页 > Deepseek最新资讯 > 正文内容

清华团队推出“安全增强版DeepSeek”

4个月前 (02-24)Deepseek最新资讯192

人民网北京2月24日电 (记者赵竹青)2月23日,清华大学计算机系相关研究团队宣布推出大语言模型RealSafe-R1。该模型基于DeepSeek R1进行深度优化与后训练,在确保性能稳定的基础上,显著提升了安全性,为开源大模型的安全发展与风险治理提供了创新性解决方案。

近日来,国产开源大模型DeepSeek在自然语言处理和多任务推理方面展现了强大的技术实力,但在面对越狱攻击等安全性挑战时仍存在一定局限性。为此,清华团队提出了基于模型自我提升的安全对齐方式,将安全对齐与内省推理相结合,使大语言模型能够通过具有安全意识的思维链分析来检查潜在风险,实现基础模型自身能力的自主进化。

基于该方法,团队对DeepSeek-R1系列模型进行后训练,正式推出RealSafe-R1系列大模型。实验数据表明,RealSafe-R1安全性提升显著,在多个基准测试中有效增强了对各种越狱攻击的抵抗力,并减轻了安全与性能之间的“跷跷板”现象。

据悉,RealSafe-R1各尺寸模型及数据集将于近期向全球开发者开源。


“清华团队推出“安全增强版DeepSeek”” 的相关文章

中新天津生态城“城市大脑”全面接入DeepSeek

中新天津生态城“城市大脑”全面接入DeepSeek

人民网天津3月27日电 (记者孙翼飞)近日,中新天津生态城(下简称“生态城”)“城市大脑”完成DeepSeek(深度求索)大模型的私有化部署,实现与城市大脑的初步集成,标志着城市大脑智慧服务能力正式迈...

济宁能源集团DeepSeek大模型成功完成本地化部署

济宁能源集团DeepSeek大模型成功完成本地化部署

近日,济宁能源集团自主研发的DeepSeek人工智能大模型已在企业内部成功完成本地化部署,标志着集团数字化转型迈入新阶段。该大模型基于开源协议框架,由科技信息中心数字化运维团队历时两个月独立完成适配与...

侨银股份携手算力中心,借 Deepseek 3.0 共启城服智能新局

侨银股份携手算力中心,借 Deepseek 3.0 共启城服智能新局

在当今时代,人工智能正深度渗透到各个行业,成为重塑产业格局的关键力量。城市运营服务领域亦不例外,“人工智能 +” 的发展模式为传统城市运营带来了前所未有的机遇与变革。侨银股份积极顺应这一趋势,携手广州...

《DeepSeek赋能数字政府应用指南》出版发行-电子书将在国内各大数字阅读平台上线

《DeepSeek赋能数字政府应用指南》出版发行-电子书将在国内各大数字阅读平台上线

新华社北京3月21日电 《DeepSeek赋能数字政府应用指南》一书近日由新华出版社出版并面向全国发行。该书电子书将在国内各大数字阅读平台上线。该书由中国经济信息社编写,内容聚焦人工智能技术在数字政府...

仙桃“城市大脑”全面接入DeepSeek

仙桃“城市大脑”全面接入DeepSeek

3月12日仙桃DeepSeek大模型本地化部署上线发布会在市民之家举行仙桃市“城市大脑”完成重磅升级完成了DeepSeek大模型本地化部署成为全省直管市中首个接入国产人工智能大模型DeepSeek的城...

哈趣投影全面接入DeepSeek!为用户量身定制专属观影盛宴

哈趣投影全面接入DeepSeek!为用户量身定制专属观影盛宴

近日,哈趣投影全面接入国产AI大模型DeepSeek,标志着智能投影行业向AI深度交互时代的跨越式迈进。在技术革新、用户体验、行业影响等方面都有着重要的意义。技术革新与交互升级1.从“被动响应”到“主...