{
  "id": 4553,
  "url": "https://arxiv.org/abs/2605.10575v1",
  "title": "Acceptance Cards:A Four-Diagnostic Standard for Safe Fine-Tuning Defense Claims",
  "summary": "Safe fine-tuning defenses are often endorsed on the basis of a held-out gap reduction, but the same reduction can come from sampling noise, subject artifacts, capability loss, or a mechanism that does not transfer. We introduce Acceptance Cards: an evaluation protocol, a documentation object, an executable audit package, and a claim-specific evidential standard for safe fine-tuning defense claims. The protocol checks statistical reliability, fresh semantic generalization, mechanism alignment, an",
  "authors": "Phongsakon Mark Konrad, Toygar Tanyel, Serkan Ayvaz",
  "category": "research",
  "topics": "safety-alignment,healthcare,military-security,transparency",
  "orgs": null,
  "regions": null,
  "published_at": "2026-05-11T13:48:42.000Z",
  "fetched_at": "2026-07-14T16:31:03.581Z",
  "source_slug": "arxiv-ethics",
  "source_name": "arXiv",
  "source_homepage": "https://arxiv.org",
  "ethics_ai_record_url": "https://ethics.ai/record/4553",
  "original_url": "https://arxiv.org/abs/2605.10575v1",
  "evidence_status": "source-only",
  "attribution": "via ethics.ai"
}