当前位置:首页 > Deepseek最新资讯 > 正文内容

清华团队推出“安全增强版DeepSeek”大语言模型RealSafe-R1

5个月前 (02-24)Deepseek最新资讯306

人民网北京2月24日电 (记者赵竹青)2月23日,清华大学计算机系相关研究团队宣布推出大语言模型RealSafe-R1。该模型基于DeepSeek R1进行深度优化与后训练,在确保性能稳定的基础上,显著提升了安全性,为开源大模型的安全发展与风险治理提供了创新性解决方案。

近日来,国产开源大模型DeepSeek在自然语言处理和多任务推理方面展现了强大的技术实力,但在面对越狱攻击等安全性挑战时仍存在一定局限性。为此,清华团队提出了基于模型自我提升的安全对齐方式,将安全对齐与内省推理相结合,使大语言模型能够通过具有安全意识的思维链分析来检查潜在风险,实现基础模型自身能力的自主进化。

基于该方法,团队对DeepSeek-R1系列模型进行后训练,正式推出RealSafe-R1系列大模型。实验数据表明,RealSafe-R1安全性提升显著,在多个基准测试中有效增强了对各种越狱攻击的抵抗力,并减轻了安全与性能之间的“跷跷板”现象。

据悉,RealSafe-R1各尺寸模型及数据集将于近期向全球开发者开源。


“清华团队推出“安全增强版DeepSeek”大语言模型RealSafe-R1” 的相关文章

春日书单,一键收藏!(DeepSeek劝学版)

春日书单,一键收藏!(DeepSeek劝学版)

谁说春天不是读书天?踏青赏花之余捧上一本好书和作者来场跨越时空的春日之约岂不美哉?今天,我们特邀AI界顶流DeepSeek共同打造了这份春日书单之DeepSeek深度推荐版!当人工智能碰上书香纸墨究竟...

四川:Deepseek等技术快速发展 带动算力相关产品新需求增加

四川:Deepseek等技术快速发展 带动算力相关产品新需求增加

4月17日,四川省政府新闻办公室举行新闻发布会,四川省统计局副局长、新闻发言人杨治刚表示,Deepseek等人工智能技术快速发展带动算力相关产品新需求增加,叠加消费品以旧换新等政策加力扩围。今年一季度...

DeepSeek,来我司裁员了

DeepSeek,来我司裁员了

AI接管人力资源部“谁家好公司开始用AI裁员了?”‍‍‍‍‍最近两个月里,AI的全民认知普及,跑出了中国速度。最焦虑的莫过于商界和职场,资本家迫切探求AI能多大程度降本增效,打工人暗自忧心饭碗不保。D...

DeepSeek本地部署,谁借“信息差”割韭菜?“解决”服务器繁忙从一分到百万元

DeepSeek本地部署,谁借“信息差”割韭菜?“解决”服务器繁忙从一分到百万元

“这本质上就是‘信息差’生意。”北京商报记者丨卢扬 程靓AI浪潮下,随着现象级应用DeepSeek爆火,市场上也兴起了“信息差”生意。临近“3·15”,有消费者反映,在本地部署DeepSeek时,容易...

DeepSeek 到底是什么?DeepSeek的七大提问技巧,小白快速上手全攻略

DeepSeek 到底是什么?DeepSeek的七大提问技巧,小白快速上手全攻略

DeepSeek 到底是什么?DeepSeek 是一家 2023 年成立的杭州初创公司,它推出的大语言模型 DeepSeek-V3 和 DeepSeek-R1,堪称 “王炸” 组合。DeepSeek-...

职场DeepSeek写材料指令100条

职场DeepSeek写材料指令100条

以下是为您整理的100条职场常用DeepSeek写材料指令,涵盖各类办公场景需求:一、工作总结类(10条)   1.生成[XXXX]年度部门工作总结模板(含数据可视化图表模块)&n...