当前位置: 首页 > news >正文

SA-ADP: Sensitivity-Aware Adaptive Differential Privacy for Large Language Models

一、文章主要内容总结

该研究聚焦大型语言模型(LLMs)训练中的个人身份信息(PII)隐私保护问题,针对传统差分隐私方法(如DP-SGD)采用统一噪声注入导致的隐私-效用权衡失衡问题,提出了敏感度感知自适应差分隐私(SA-ADP)框架。其核心思路是根据训练数据中各PII令牌的敏感度动态分配噪声,实现细粒度隐私保护。

SA-ADP的三阶段核心流程:

  1. PII检测:利用基于LangChain和LLaMA 3的隐私代理自动提取训练数据中的敏感令牌;
  2. 敏感度评分:从频率(稀有度)、可链接性(与其他信息关联能力)、数据类型(是否受全球隐私法规保护)三个维度,通过加权线性组合计算令牌的归一化敏感度分数(0.0-1.0);
  3. 自适应噪声校准:基于敏感度分数分配高斯噪声(高敏感度令牌:σ=3.0;低敏感度令牌:σ=2.0;非敏感令牌:无噪声),并通过Rényi差分隐私(RDP)会计框架跟踪隐私损失预算。

实验验证:在UNSW-NB15(结构化)、ABCD、CUSTOMERSIM(对话类)、Wikitext-2(非结构化)四个数据集上微调GPT-2模型,结果显示SA-ADP在保持99%基线模型(无DP)效用(准确率、困惑度)的同时,隐私损失预算(ε)较传统DP-SGD降低约75%,且在不同PII密度、不同数据类型场景下均表现稳定。

二、文章创新点

  1. 令牌级自适应隐私机制:突破传统D
http://www.cnnetsun.cn/news/4171908.html

相关文章:

  • 设计模式——装饰模式
  • Makefile头文件依赖自动生成:-MMD与-include实战指南
  • 从FFmpeg到Pillow:构建高效自动化文件格式转换技术栈
  • FPGA FIFO 为什么会多写一拍、少读一拍?从指针回绕到 Gray 码讲透满空判断
  • 【Python量化实战 #05】财报三大报表看花眼?3 步用 Python 拉齐资产负债表、利润表与现金流
  • 金融大模型安全框架FinHarness:为AI智能体编织实时防护网
  • C++函数模板编译机制解析:从蓝图到实例化的完整过程
  • 统计学习入门:从数据中学习规律,掌握预测与推断的核心方法
  • 橙皮书共读|Hermes Agent(二)深度拆解五大核心支柱:自进化智能体的运行内核
  • 嵌入式系统核心MCU、MPU与SoC深度解析:从概念到实战选型指南
  • AI智能体通信格式基准测试:TOON、TRON与JSON的性能较量
  • AI大模型学习路线:从零基础到求职实战
  • Windows 提权方法与步骤
  • Effective C++ 学习笔记 条款43 学习处理模板化基类内的名称
  • ACM模式训练系统:从解题到工程化交付的实战指南
  • Linux PipeWire深度解析之pw_context_connect调用流程与实战(七十七)
  • 深入解析JavaScript原型链继承:从原理到ES6 Class的底层实现
  • 【MATLAB例程,车联网16】基于V2X通信的干线绿波速度引导控制仿真——多交叉口信号相位信息驱动的车速动态优化,对比无引导的停车次数、总延误、时距轨迹及交叉口通过时间。附下载链接
  • Lucas定理优化实现:大组合数模小质数的高效计算
  • 嵌入式开发工程师转型:从C语言到Linux驱动的系统学习路径与实战指南
  • [论文学习]VIPER-MCP:检测与利用模型上下文协议服务器中的汙点型漏洞
  • 数据流健康度评估与故障传播建模:从系统韧性到应急决策优化
  • 蓝桥杯真题解析:素因子去重算法与质因数分解优化
  • 2026年教育行业客户体验管理系统推荐:AI大模型VOC智能归因与投诉工单自动分类实践
  • 法国公司注册证明(K-bis)全解读:一文看懂法国企业的“身份证”
  • 2056台机器人北京集结,世界人形机器人运动会开赛
  • Visual Studio代码颜色自定义:从显示项到C/C++开发环境优化
  • 生产级MCP落地指南:FastMCP与官方MCP SDK的选型、架构与实战
  • 三维动画如何成为医学设备技术沟通的工程级解决方案
  • LLM代码生成与任务规划中的采样-验证模式:原理、风险与工程实践