Back to feed
arXiv cs.CL·

PreUnlearn: Auditing Collateral Knowledge Damage Before Large Language Model Unlearning

Signal
72
Hype
15
In three linesStudy of collateral damage in LLM machine unlearning. Authors show damage propagates beyond the forget set following semantic distance gradients, and propose PreUnlearn, a pre-unlearning prediction method to audit risks before execution.
Read source
Your take?
AI safetyAlignmentPapersEvals

Summary generated by Claude — human-verified