当前位置:首页 > Deepseek最新资讯 > 正文内容

清华团队推出“安全增强版DeepSeek”

9个月前 (02-24)Deepseek最新资讯424

人民网北京2月24日电 (记者赵竹青)2月23日,清华大学计算机系相关研究团队宣布推出大语言模型RealSafe-R1。该模型基于DeepSeek R1进行深度优化与后训练,在确保性能稳定的基础上,显著提升了安全性,为开源大模型的安全发展与风险治理提供了创新性解决方案。

近日来,国产开源大模型DeepSeek在自然语言处理和多任务推理方面展现了强大的技术实力,但在面对越狱攻击等安全性挑战时仍存在一定局限性。为此,清华团队提出了基于模型自我提升的安全对齐方式,将安全对齐与内省推理相结合,使大语言模型能够通过具有安全意识的思维链分析来检查潜在风险,实现基础模型自身能力的自主进化。

基于该方法,团队对DeepSeek-R1系列模型进行后训练,正式推出RealSafe-R1系列大模型。实验数据表明,RealSafe-R1安全性提升显著,在多个基准测试中有效增强了对各种越狱攻击的抵抗力,并减轻了安全与性能之间的“跷跷板”现象。

据悉,RealSafe-R1各尺寸模型及数据集将于近期向全球开发者开源。


“清华团队推出“安全增强版DeepSeek”” 的相关文章

DeepSeek在线使用指南:解锁高效智能体验

DeepSeek在线使用指南:解锁高效智能体验

DeepSeek在线使用指南:解锁高效智能体验一、引言在当今信息爆炸的时代,如何快速准确地获取所需信息成为了每个人面临的挑战。DeepSeek作为一款功能强大的人工智能工具,以其高效的搜索能力、用户友...

医学博主自嘲“天塌了”:患者查询DeepSeek后“质疑”治疗方案,而且它是对的

医学博主自嘲“天塌了”:患者查询DeepSeek后“质疑”治疗方案,而且它是对的

昨(22)日,广东一名医学博主上网发帖称,自己为病人开出治疗方案,对方查询DeepSeek后称有问题,自己“气得又查了一遍医学指南”,结果发现医学指南更新了,自嘲感觉“天塌了”。DeepSeek真的这...

肥城市新城街道:这篇推文,是我用DeepSeek写的!

肥城市新城街道:这篇推文,是我用DeepSeek写的!

4月11日,新城街道举办的一场关于DeepSeek与AIGC深度应用培训讲座,颠覆了基层干部对AI工具的认知。聊城市人工智能学会产教融合专委会秘书长段琳钰老师通过分析使用提示词的常见错误,普及常用提示...

观察:有人炒股,有人算命,DeepSeek咋用才能飞起来

观察:有人炒股,有人算命,DeepSeek咋用才能飞起来

春节期间,一款名为DeepSeek的国产AI工具以“技术奇迹”与“社交狂欢”的双重姿态席卷全网,成为新年最火的现象级网红。从股市前瞻到算命预测,再到情感陪伴,DeepSeek“无所不能”的神奇特质吸引...

2025年高考倒计时 deepseek挑战作家张一一高考作文

2025年高考倒计时 deepseek挑战作家张一一高考作文

2025年高考进入最后的冲刺倒计时DeepSeek、Manus、ChatGPT等AI与作家张一一高考作文的“华山论剑”成看点2025年全国高考进入最后十多天的冲刺倒计时。今年高考DeepSeek、Ma...

洛江打造泉州首个接入DeepSeek卫品行业智能体

洛江打造泉州首个接入DeepSeek卫品行业智能体

 近日,洛江区工信局、数据管理局持续推进人工智能与实体经济深度融合,成功指导泉州天娇妇幼卫生用品有限公司率先实现DeepSeek私有化部署并深度融入车间生产流程,形成“问题上报-分析-解决-归档”闭环...