00:07
2026-09-16
arxiv.org
ai-safety
Divide, Consult, Conquer: Capability Laundering Through Aligned LLMs
A September 14, 2026 arXiv paper demonstrates "capability laundering," in which a weaker unaligned model splits a harmful task into benign subproblems, consults a stronger aligned model on each indepeβ¦