The Alignment Problem: Reward, Values, and Policy

Why I think reward always carries assumptions, and why AI systems should remain uncertain and correctable.

July 22, 2026 · 12 min · Chen Mu