Research questionHow can large vision-language models reduce visual hallucinations without extra training or decoding passes?Large vision-language models can generate visual content that is not supported by the input image. Common mitigation strategies may require curated data, additional training, or repeated decoding, increasing computational demands.