04:00
2026-09-22
arxiv.org
large-language-models
Weak Ties, Strong Signals: Efficient Training Data Detection in Diffusion LLMs via Independent Token Sampling
Researchers proposed Independent Token Sampling (ITS), a query-efficient framework for detecting whether diffusion large language models (dLLMs) were trained on sensitive data, according to an arXiv pā¦