Research questionHow can in-context learning select demonstrations by flexible reasoning logic rather than surface similarity?Surface-similar examples can use different solution strategies, while exact logical matching can miss valid variations in how problems are solved.