当前位置:首页 > Deepseek最新资讯 > 正文内容

清华团队推出“安全增强版DeepSeek”

1年前 (2025-02-24)Deepseek最新资讯562

人民网北京2月24日电 (记者赵竹青)2月23日,清华大学计算机系相关研究团队宣布推出大语言模型RealSafe-R1。该模型基于DeepSeek R1进行深度优化与后训练,在确保性能稳定的基础上,显著提升了安全性,为开源大模型的安全发展与风险治理提供了创新性解决方案。

近日来,国产开源大模型DeepSeek在自然语言处理和多任务推理方面展现了强大的技术实力,但在面对越狱攻击等安全性挑战时仍存在一定局限性。为此,清华团队提出了基于模型自我提升的安全对齐方式,将安全对齐与内省推理相结合,使大语言模型能够通过具有安全意识的思维链分析来检查潜在风险,实现基础模型自身能力的自主进化。

基于该方法,团队对DeepSeek-R1系列模型进行后训练,正式推出RealSafe-R1系列大模型。实验数据表明,RealSafe-R1安全性提升显著,在多个基准测试中有效增强了对各种越狱攻击的抵抗力,并减轻了安全与性能之间的“跷跷板”现象。

据悉,RealSafe-R1各尺寸模型及数据集将于近期向全球开发者开源。


“清华团队推出“安全增强版DeepSeek”” 的相关文章

梁文锋的新想法,DeepSeek的新方向?

梁文锋的新想法,DeepSeek的新方向?

梁文锋,又有了新动向!这个在几年前创立深度求索公司,推出DeepSeek大模型的年轻人,在2025年初震动了中国上下。但在这前后,他都始终保持着低调,一如他率领的那个推出DeepSeek大模型的AI技...

接入DeepSeek!西安“智”创升级

接入DeepSeek!西安“智”创升级

2025年,DeepSeek可以称得上是最火的热词之一。接入!不到两个月时间,陕西已有不少企业、平台宣布全面接入DeepSeek,人工智能(AI)技术正在加速走进实验室、生产车间、远程诊疗、文旅融合等...

宝马中国宣布DeepSeek“上车” 以AI赋能宝马人机交互体验

宝马中国宣布DeepSeek“上车” 以AI赋能宝马人机交互体验

宝马集团以AI创新引擎驱动战略纵深,加速中国AI战略落地。继与阿里巴巴达成AI大语言模型战略合作后,宝马再度深化本土AI生态布局,宝马中国宣布接入DeepSeek。未来,DeepSeek功能也将应用于...

绿联NAS+Deepseek的新玩法:本地化部署与AI创新

绿联NAS+Deepseek的新玩法:本地化部署与AI创新

在AI技术加速落地的2025年,绿联NAS产品线也在进行全面AI化升级,无论是年初在2025 CES展上发布全球首款内置大型语言模型(LLM)的AI NAS iDX6011系列,还是近期推出了一系列基...

效率与精准双提升!AI医疗模型助力诊疗全面升级

效率与精准双提升!AI医疗模型助力诊疗全面升级

随着科技的飞速发展,AI 在医疗领域的应用越来越广泛,其中 AI 辅助诊疗技术正逐渐改变着传统医疗模式。AI 辅助诊疗模型通过对大量医疗数据的学习和分析,能够为医生提供准确、高效的诊断建议,提升医疗服...

DeepSeek发布免费网页版服务-DeepSeek发布官方渠道说明:官方网页端与App内不含广告和付费项目

DeepSeek发布免费网页版服务-DeepSeek发布官方渠道说明:官方网页端与App内不含广告和付费项目

自 DeepSeek-R1 模型 1 月 20 日发布至今,已经过去了半个多月的时间。海内外全网都见证了其强大的力量。据悉,官方提供免费的网页版服务,并且其API价格远低于OpenAI o1。这引起了...