01:02
2026-08-11
lesswrong.com
large-language-models
A study on instability of LLM responses as a behavioral signature of self-Referential reports.
A new experiment measuring semantic instability in large language model (LLM) responses finds that self-referential questions produce the most unstable outputs, followed by open-ended and closed-endedβ¦