🧠 LawZero proposes a framework for safety in AI predictors by emphasizing honest outputs over alignment with user prefer...
🧠 LawZero proposes a framework for safety in AI predictors by emphasizing honest outputs over alignment with user preferences. The approach suggests that disinterested AI systems c...