Story
arxiv_cs_ai ยท Aug 26, 2026 ยท paper
arxiv.orgAug 26, 2026
original source linked
In brief
Agentic LLM pipelines face escalating inference costs as context accumulates across retrieval, tool use, and multi-turn interactions. To control latency, deployments routinely compress inputs, but this degrades task a...
Feed lens
agenticeval