{
  "id": 12289,
  "url": "https://arxiv.org/abs/2607.18366",
  "title": "Operational Hallucination and Safety Drift in AI Agents",
  "summary": "arXiv:2607.18366v1 Announce Type: cross Abstract: Large language models (LLMs) serving as planners in tool-using autonomous agents introduce dynamic reliability risks in multi-turn execution. While single-turn safety mechanisms are relatively mature, extended interactions reveal structural vulnerabilities where initial alignment degrades over time. This paper empirically characterizes two observed failure modes across multiple state-of-the-art LLMs: Safety Drift, the gradual erosion of declared",
  "authors": "Shasha Yu, Fiona Carroll, Barry L. Bentley",
  "category": "research",
  "topics": "safety-alignment,agents-autonomy",
  "orgs": null,
  "regions": null,
  "published_at": "2026-07-22T04:00:00.000Z",
  "fetched_at": "2026-07-22T05:10:49.469Z",
  "source_slug": "arxiv-cscy",
  "source_name": "arXiv cs.CY",
  "source_homepage": "https://arxiv.org/list/cs.CY/recent",
  "ethics_ai_record_url": "https://ethics.ai/record/12289",
  "original_url": "https://arxiv.org/abs/2607.18366",
  "evidence_status": "source-only",
  "attribution": "via ethics.ai"
}