Research questionHow should dependent LLM inference tasks be coordinated across edge servers when deadlines allow only limited extensions?A missed deadline for one dependent subtask can compromise an entire inference request. Distributed edge servers must therefore allocate work under tight latency limits while using only a constrained amount of deadline flexibility.