计算机研究与发展

北大核心,JST,Pж(AJ),EI,CSCD

国内刊号:11-1777/TP

国际刊号:1000-1239

计算机研究与发展杂志2025年第8期:大语言模型安全与隐私风险综述

发布日期:

作者:姜毅,杨勇,印佳丽,刘小垒,李吉亮,王伟,田有亮,巫英才,纪守领,

关键词:大语言模型, 预训练语言模型, 安全, 隐私, 威胁,

近年来,大语言模型(largelanguagemodel,LLM)作为深度学习网络技术的关键分支,在自然语言处理(naturallanguageprocessing,NLP)领域取得了一系列突破性成就,并被广泛采用.然而,在其包括预训练、微调和实际部署在内的完整生命周期中,多种安全威胁和隐私泄露的风险相继被发现,引起了学术和工业界越来越多的关注.首先以LLM发展过程中出现的预训练-微调范式、预训练-提示学习范式和预训练-指令微调范式为线索,梳理了针对LLM的常规安全威胁,即3种对抗攻击(对抗样本攻击、后门攻击、投毒攻击)的代表性研究,接着总结了一些最新工作披露的新型安全威胁,然后介绍了LLM的隐私风险及其研究进展.相关内容有助于LLM的研究和部署者在模型设计、训练及应用过程中,识别、预防和缓解这些威胁与风险,同时实现模型性能与安全及隐私保护之间的平衡.

来源:2025年第8期

《计算机研究与发展》期刊编辑部

查看计算机研究与发展杂志2025年第8期

联系我们

  • 地址:北京中关村科学院南路6号
  • 电话:(010)62620696
  • E-mail:crad@ict.ac.cn

咨询工作人员