21:01
2026-08-10
pub.towardsai.net
artificial-intelligence
The Multi-Lingual Trojan: Why Aligning LLMs in English Creates Blind Spots in Latent Space
A new analysis reveals that aligning large language models (LLMs) in English creates latent vulnerabilities that allow harmful inputs in low-resource languages to bypass safety guardrails. Researchersβ¦