当前位置:首页 > Deepseek最新资讯 > 正文内容

清华团队推出“安全增强版DeepSeek”

2个月前 (02-24)Deepseek最新资讯128

人民网北京2月24日电 (记者赵竹青)2月23日,清华大学计算机系相关研究团队宣布推出大语言模型RealSafe-R1。该模型基于DeepSeek R1进行深度优化与后训练,在确保性能稳定的基础上,显著提升了安全性,为开源大模型的安全发展与风险治理提供了创新性解决方案。

近日来,国产开源大模型DeepSeek在自然语言处理和多任务推理方面展现了强大的技术实力,但在面对越狱攻击等安全性挑战时仍存在一定局限性。为此,清华团队提出了基于模型自我提升的安全对齐方式,将安全对齐与内省推理相结合,使大语言模型能够通过具有安全意识的思维链分析来检查潜在风险,实现基础模型自身能力的自主进化。

基于该方法,团队对DeepSeek-R1系列模型进行后训练,正式推出RealSafe-R1系列大模型。实验数据表明,RealSafe-R1安全性提升显著,在多个基准测试中有效增强了对各种越狱攻击的抵抗力,并减轻了安全与性能之间的“跷跷板”现象。

据悉,RealSafe-R1各尺寸模型及数据集将于近期向全球开发者开源。


“清华团队推出“安全增强版DeepSeek”” 的相关文章

返利科技新增“DeepSeek概念”

返利科技新增“DeepSeek概念”

2025年4月24日,返利科技(600228)新增“DeepSeek概念”。据同花顺数据显示,入选理由是:2025年4月15日互动易,公司在线导购产品“返利”IOS版已接入DeepSeek(深度求索旗...

思想者 | 金耀辉:DeepSeek破局,中国式创新如何改变AI未来?

思想者 | 金耀辉:DeepSeek破局,中国式创新如何改变AI未来?

【编者按】今年年初DeepSeek的出圈,让人看到国产大模型的巨大潜力。技术正以惊人的速度改变着人们的生活和工作方式,而如何认知技术正在成为互联网时代的“必修课”。在上海交通大学电信学院长聘教授金耀辉...

汉王科技:目前公司的电纸本全系产品已经接入Deepseek-R1和V3模型

汉王科技:目前公司的电纸本全系产品已经接入Deepseek-R1和V3模型

每经AI快讯,有投资者在投资者互动平台提问:请问贵司有没有Deepseek概念?汉王科技(002362.SZ)4月10日在投资者互动平台表示,目前公司的电纸本全系产品已经接入Deepseek-R1和V...

从DeepSeek看人工智能自主创新的战略价值

从DeepSeek看人工智能自主创新的战略价值

随着全球科技竞争的加剧,人工智能已成为国家竞争力的重要标志。无论是国家还是行业、个人,都在积极探索如何利用人工智能赋能发展、推动产业升级和产品创新,以及个人职业发展。今年年初,DeepSeek推出的D...

DeepSeek+水利 治水迎“智”变

DeepSeek+水利 治水迎“智”变

今年以来,随着以DeepSeek为代表的人工智能技术向垂直领域加速渗透,水利行业也迎来新一轮技术应用变革。目前,全省水利系统正积极开展“DeepSeek+水利”的相关应用,除了已经上线“DS都江堰”智...

《数势科技黎科峰博士:Agent接入DeepSeek,将帮助企业打通数据应用最后一公里》

《数势科技黎科峰博士:Agent接入DeepSeek,将帮助企业打通数据应用最后一公里》

近日,数势科技创始人兼 CEO 黎科峰博士出席由知名科技媒体InfoQ 策划的 DeepSeek 系列直播系列节目。在直播中,极客邦科技创始人  &CEO 霍太稳对话黎科峰博士,深入探讨了回归...