20:44
2026-08-14
lesswrong.com
artificial-intelligence
Training a Conceptual Reasoning Judge
Researchers at the Alignment Research Group fine-tuned Qwen 3.6-27B on the LMCA conceptual reasoning dataset to output critique ratings in a single forward pass, achieving significant uplift in alignmβ¦