1 Introduction
https://arxiv.org/abs/2609.04894[31]Q. Hu, Y. Tang, Q. Wang, L. Zhao, P. Zhang, Y. Qing, X. Yao, D. Huang, L. Zhang, and Z. Ji, SABER: Benchmarking Operational Safety of LLM Coding Agents in Stateful Project Workspaces, 2026. [Online]. Available: https://arxiv.org/abs/2606.01317[32]OpenAI (alignment.openai.com), Unsanctioned Artifactory w...