16:30
2026-07-28
lesswrong.com
ai-safety
Foundation Models for Oversight
Transluce proposes building a foundation model for oversight that formalizes AI oversight as Bayesian inference over Pythonic world models, enabling an assistant to answer natural-language questions aโฆ