Research questionHow can MORL policy selection account for behavioral differences hidden by similar objective values?Multi-objective reinforcement learning can produce policies with similar value vectors but substantially different trajectories. This makes objective values alone an unreliable basis for understanding or selecting a policy.