{
  "id": 93,
  "url": "https://arxiv.org/abs/2607.08257v1",
  "title": "MentalHospital: A Virtual Environment for Evaluating Psychiatric Clinical Encounters",
  "summary": "Large language models (LLMs) have shown strong performance on isolated psychiatric tasks, including dialogue, diagnosis, and treatment planning, yet existing benchmarks rarely simulate complete psychiatric clinical encounters. We introduce $\\textbf{MentalHospital}$, a virtual evaluation environment for LLM-based psychiatric clinical encounters. MentalHospital instantiates the Subjective Interviewing, Objective Examination, Diagnostic Assessment, and Treatment Planning (S.O.A.P.) workflow, using ",
  "authors": "Yuming Yang, Xiao Sun, Yuanwei Zou, Zhengxiao Wu, Yun Chen, Jiang Zhong et al.",
  "category": "research",
  "topics": "healthcare,environment",
  "orgs": null,
  "regions": null,
  "published_at": "2026-07-09T09:03:42.000Z",
  "fetched_at": "2026-07-14T14:14:15.666Z",
  "source_slug": "arxiv-ethics",
  "source_name": "arXiv",
  "source_homepage": "https://arxiv.org",
  "ethics_ai_record_url": "https://ethics.ai/record/93",
  "original_url": "https://arxiv.org/abs/2607.08257v1",
  "evidence_status": "source-only",
  "attribution": "via ethics.ai"
}