Logit Laundering: Evading Data-Use Auditing in Large Language Models
Ruihan Hu, Wei Luo, Yu-Ming Shang, Jiakai Wang, Chuxuan Zhang, Mei Li, Xi Zhang, Meikang Qiu
2026年份
问问这篇 Paper
问问你的智能体。
Lune 读过与它相关的顶会 Paper,每个回答都会注明依据哪几篇。
相关 Paper
- SymSan: Mitigating Malware Embedding in Large Language Models via Parameter Space SymmetryMing Tan, Wei Li, Tao Hu, Qian Chen 等CCS 2026
- From Snapshot to Snooping: An Empirical Study on Geolocation Privacy Leakage in Large Vision Language ModelsYihe Zhou, Tao Ni, Qingchuan Zhao, Cong WangCCS 2026
- Thinking Dangerously: How Reasoning Training Dilutes Safety in Language ModelsDongxin Guo, Jikun Wu, Siu Ming YiuCCS 2026
- Language Models can Subtly Deceive Without Lying: A Case Study on Strategic Phrasing in LegislationAtharvan Dogra, Krishna Pillutla, Ameet Deshpande, Ananya B. Sai 等ACL 2025
- Quantifying Memorization Across Neural Language ModelsNicholas Carlini, Daphne Ippolito, Matthew Jagielski, Katherine Lee 等ICLR 2023 · 被引用 158 次
