当前位置:首页 > Deepseek最新资讯 > 正文内容

清华团队推出“安全增强版DeepSeek”大语言模型RealSafe-R1

2个月前 (02-24)Deepseek最新资讯141

人民网北京2月24日电 (记者赵竹青)2月23日,清华大学计算机系相关研究团队宣布推出大语言模型RealSafe-R1。该模型基于DeepSeek R1进行深度优化与后训练,在确保性能稳定的基础上,显著提升了安全性,为开源大模型的安全发展与风险治理提供了创新性解决方案。

近日来,国产开源大模型DeepSeek在自然语言处理和多任务推理方面展现了强大的技术实力,但在面对越狱攻击等安全性挑战时仍存在一定局限性。为此,清华团队提出了基于模型自我提升的安全对齐方式,将安全对齐与内省推理相结合,使大语言模型能够通过具有安全意识的思维链分析来检查潜在风险,实现基础模型自身能力的自主进化。

基于该方法,团队对DeepSeek-R1系列模型进行后训练,正式推出RealSafe-R1系列大模型。实验数据表明,RealSafe-R1安全性提升显著,在多个基准测试中有效增强了对各种越狱攻击的抵抗力,并减轻了安全与性能之间的“跷跷板”现象。

据悉,RealSafe-R1各尺寸模型及数据集将于近期向全球开发者开源。


“清华团队推出“安全增强版DeepSeek”大语言模型RealSafe-R1” 的相关文章

航天宏图:DeepSeek已经部署完毕

航天宏图:DeepSeek已经部署完毕

每经快讯,航天宏图(688066)2月18日在互动平台表示,DeepSeek已经部署完毕,并在天权智能体上线。每日经济新闻...

弘亚数控售后服务系统接入Deepseek

弘亚数控售后服务系统接入Deepseek

弘亚数控售后服务系统接入Deepseek每经AI快讯,有投资者在投资者互动平台提问:您好,建议弘亚数控及其子公司工业软件尽快接入DeepSeek,以提供公司工作、生产效率,谢谢。弘亚数控(002833...

deepseek算命准吗?deepseek能算命吗?

deepseek算命准吗?deepseek能算命吗?

好的,用户现在问的是“deepseek算命准吗”。首先,我需要确定用户到底在问什么。DeepSeek是一个人工智能公司,主要专注于大模型领域,所以这里提到的“算命”可能是指他们的某个产品或者服务。不过...

DeepSeek详细介绍DeepSeek在商业咨询领域有哪些重要应用场景?

DeepSeek详细介绍DeepSeek在商业咨询领域有哪些重要应用场景?

DeepSeek详细介绍DeepSeek在商业咨询领域有哪些重要应用场景?<think> 嗯,用户之前问过DeepSeek在科技领域哪些应用场景,我详细回答了自动驾驶、智能视频、推荐、助...

学烧菜、学剪视频,老年居民学用DeepSeek解锁智能生活

学烧菜、学剪视频,老年居民学用DeepSeek解锁智能生活

随着人工智能发展火热,deepseek问世后掀起了一股全民学习的热潮。近日,四平路街道阜新路社区睦邻中心组织开展了专门的教学活动,教老年人如何使用deepseek并普及人工智能知识,助力老年人跨越“数...

大厂加码,小厂离席:DeepSeek驱动的MaaS之变

大厂加码,小厂离席:DeepSeek驱动的MaaS之变

文 | 脑极体月初,潞晨科技创始人提出MaaS(Model as a Service,模型即服务)是“最差的商业模式”,满血版DeepSeek-R1月亏损超过4亿元,并宣布停止DeepSeek API...