当前位置:首页 > Deepseek最新资讯 > 正文内容

清华团队推出“安全增强版DeepSeek”大语言模型RealSafe-R1

1年前 (2025-02-24)Deepseek最新资讯628

人民网北京2月24日电 (记者赵竹青)2月23日,清华大学计算机系相关研究团队宣布推出大语言模型RealSafe-R1。该模型基于DeepSeek R1进行深度优化与后训练,在确保性能稳定的基础上,显著提升了安全性,为开源大模型的安全发展与风险治理提供了创新性解决方案。

近日来,国产开源大模型DeepSeek在自然语言处理和多任务推理方面展现了强大的技术实力,但在面对越狱攻击等安全性挑战时仍存在一定局限性。为此,清华团队提出了基于模型自我提升的安全对齐方式,将安全对齐与内省推理相结合,使大语言模型能够通过具有安全意识的思维链分析来检查潜在风险,实现基础模型自身能力的自主进化。

基于该方法,团队对DeepSeek-R1系列模型进行后训练,正式推出RealSafe-R1系列大模型。实验数据表明,RealSafe-R1安全性提升显著,在多个基准测试中有效增强了对各种越狱攻击的抵抗力,并减轻了安全与性能之间的“跷跷板”现象。

据悉,RealSafe-R1各尺寸模型及数据集将于近期向全球开发者开源。


“清华团队推出“安全增强版DeepSeek”大语言模型RealSafe-R1” 的相关文章

DeepSeek热度狂飙,运营商、手机厂抢着用!

DeepSeek热度狂飙,运营商、手机厂抢着用!

近期,DeepSeek访问使用量急速上升,已经成为目前最快突破3000万日活跃用户量的应用程序。记者从工业和信息化部了解到,三家基础电信企业已全面接入国产开源大模型DeepSeek。除了运营商的云平台...

DeepSeek开源周第三日 发布高性能通用矩阵乘法库

DeepSeek开源周第三日 发布高性能通用矩阵乘法库

新京报贝壳财经讯(记者罗亦丹)北京时间2月26日,DeepSeek进行了其开源周第三日的发布——DeepGEMM,一个支持密集和MoE(专家混合模型)GEMM(通用矩阵乘法)的FP8 (8位浮点数)G...

文心一言:Deepseek在金融证券行业应用有哪些?

文心一言:Deepseek在金融证券行业应用有哪些?

文心一言:Deepseek在金融证券行业应用有哪些?DeepSeek在金融证券行业的应用十分广泛,主要体现在以下几个方面:一、风险管理与信用评估企业信贷风险分析:整合企业财报、舆情数据、供应链关系等信...

deepseek正确用法,deepseek app能做什么?

deepseek正确用法,deepseek app能做什么?

DeepSeek的正确用法以及DeepSeek APP的功能介绍如下:DeepSeek的正确用法安装与配置:访问DeepSeek官网,下载最新版本的安装包,并按照提示完成安装。将DeepSeek的安装...

南网储能:公司已私有化部署DeepSeek-R1模型

南网储能:公司已私有化部署DeepSeek-R1模型

每经AI快讯,有投资者在投资者互动平台提问:董秘您好,公司官微发布‘储能LCDP’助推南网储能多业务领域数字化转型,未来是否会考虑与deepseek合作,进一步完善数字化转型?南网储能(600995....

青青们快看过来,“青春来宾”携手DeepSeek让你的青春搭子24小时在线!

青青们快看过来,“青春来宾”携手DeepSeek让你的青春搭子24小时在线!

你的青春小助手来啦!“青春来宾” × DeepSeek亲爱的“青春来宾”粉丝们,重磅消息来啦!从今天开始,团团正式宣布共青团来宾市委员会官方新媒体平台“青春来宾”微信公众号平台正式接入DeepSeek...