Research questionHow can vision-language models reliably report clinically meaningful changes between serial CT scans?Clinical interpretation often depends on how disease changes between studies, but models focused on individual CT scans may miss or misstate those interval changes.