Research questionHow can autonomous LLM agents detect attacks whose evidence accumulates across loop iterations?Autonomous agents may encounter attacks whose evidence is split across multiple iterations. Safeguards that reset at each trajectory can miss this cumulative pattern.