Research questionHow can we learn welfare-optimal approximate Nash equilibria in concurrent stochastic games under uncertain transitions while certifying exact-equilibrium nonexistence?Limited trajectory data leaves the game’s transition dynamics uncertain, making equilibrium computation unreliable. The learning procedure must also distinguish an approximate equilibrium from cases where no exact Nash equilibrium exists.