Research questionHow can safe reinforcement learning enforce infinitely many continuous-space constraints while remaining computationally tractable?Safe RL must optimize long-term reward while satisfying safety conditions at every point in a continuous parameter space. Finite approximations can miss violations or provide only probabilistic assurances, making reliable global guarantees difficult to obtain.