04:00
2026-09-22
arxiv.org
ai-safety
SafeTune: A Unified Faithful Library for Auditing and Repairing Safety Drift in Fine-Tuned LLMs
Researchers released SafeTune, a source-available library that unifies four intervention paradigms for auditing and repairing safety drift in fine-tuned large language models: post-hoc weight recoveryβ¦