22:31
2026-08-15
lesswrong.com
artificial-intelligence
Kimi likes causal decision theory more after RL in twin prisoner’s dilemmas
Reinforcement learning in twin prisoner's dilemma environments made Kimi K2.6, a language model by Moonshot AI, more sympathetic to causal decision theory (CDT), including on abstract questions, accor…