Story
arxiv_cs_ai ยท Aug 27, 2026 ยท paper
arxiv.orgAug 27, 2026
original source linked
In brief
LLM-based agents are increasingly deployed in product-level execution harnesses, where jailbreaks can trigger harmful tool use and persistent state changes, creating greater risks than unsafe text generation alone. Ex...
Feed lens
agenticharnesseval