{"as_of":"2026-08-07T05:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c6e2ff39283f6bc91a7b2d578f9e18195110359985acdf19d27afa0da4f97016","coverage":[{"denominator":6,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T21:35:34.616461Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":20,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T01:12:44.184834Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2509.09870","last_updated":"2026-04-29T01:28:14Z","snapshot_observed_at":"2026-07-06T22:29:01.585836Z","submitted_at":"2025-09-11T21:43:49Z","title":"Vibe Check: Understanding the Effects of LLM-Based Conversational Agents' Personality and Alignment on User Perceptions in Goal-Oriented Tasks","version":2},"reference_index":114,"source":"pdf_text","source_observed_at":"2026-05-18T17:00:06.402954Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2509.09870"},"observation_digest":"sha256:52ff7e151255b3027eecbafe717e401bef3f21ef77822afe094343e4cbe49969","observation_id":"d5e3815c-4641-4358-ba47-d92df3d6a102","resolution":{"observed_at":"2026-05-18T17:01:38.344182Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2509.26238","last_updated":"2026-04-21T11:04:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-30T13:32:59Z","title":"Beyond Linear Probes: Dynamic Safety Monitoring for Language Models","version":4},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-05-18T12:41:48.620040Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2509.26238"},"observation_digest":"sha256:e05a8d222c343cb7737ada24fd0890b9b41ec1ef1a380b87561d6351aed18acb","observation_id":"5896c4be-d5ba-4f1d-b9d4-3591bf8b6ef7","resolution":{"observed_at":"2026-05-18T12:42:36.853762Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2604.07709","last_updated":"2026-06-03T21:15:24Z","snapshot_observed_at":"2026-07-13T00:19:28.134640Z","submitted_at":"2026-04-09T01:54:33Z","title":"IatroBench: Pre-Registered Evidence of Iatrogenic Harm from AI Safety Measures","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-10T18:25:53.037936Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2604.07709"},"observation_digest":"sha256:168279d10e4efdcf674d3d5a73bf05addc1e801235c5444f1832b9dfa9c53daa","observation_id":"36ecda09-0937-4c16-ab76-00ee4d62cc54","resolution":{"observed_at":"2026-05-11T00:35:52.616391Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-07-13T00:19:33.861692Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.07709","last_updated":"2026-06-03T21:15:24Z","snapshot_observed_at":"2026-07-13T00:19:28.134640Z","submitted_at":"2026-04-09T01:54:33Z","title":"IatroBench: Pre-Registered Evidence of Iatrogenic Harm from AI Safety Measures","version":4},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-13T00:19:33.861692Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2604.07709"},"observation_digest":"sha256:c93e677138df4779da54668bb703b84bbd7e1390105db44df8d3f2355aac4dcf","observation_id":"07612579-4de2-4a67-a42e-7fd7c0e3ed24","resolution":{"observed_at":"2026-07-13T00:19:33.861692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2604.17299","last_updated":"2026-04-21T06:17:50Z","snapshot_observed_at":"2026-07-06T23:04:28.260463Z","submitted_at":"2026-04-19T07:29:37Z","title":"Cat-DPO: Category-Adaptive Safety Alignment","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T05:33:32.642379Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2604.17299"},"observation_digest":"sha256:e1f00a2e92a0647a1433304241e09360ad8637f8bc1a69afb918da5b06b9a268","observation_id":"66929448-40e1-4ddf-be66-fc7de901521d","resolution":{"observed_at":"2026-05-10T05:36:01.750925Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2604.18463","last_updated":"2026-05-03T16:42:04Z","snapshot_observed_at":"2026-07-06T23:05:17.639285Z","submitted_at":"2026-04-20T16:18:08Z","title":"Using large language models for embodied planning introduces systematic safety risks","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-10T04:45:46.483867Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2604.18463"},"observation_digest":"sha256:9ceaf718a465fb4fe256d296b063da063006c3b674bef0decaaf3cf92ac24885","observation_id":"41e0bb4f-39d5-48a6-83fc-c31191e12e91","resolution":{"observed_at":"2026-05-10T11:40:20.104188Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2604.24082","last_updated":"2026-04-27T06:12:43Z","snapshot_observed_at":"2026-07-06T23:10:12.016186Z","submitted_at":"2026-04-27T06:12:43Z","title":"Jailbreaking Frontier Foundation Models Through Intention Deception","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-08T03:17:51.039062Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2604.24082"},"observation_digest":"sha256:2960f3918265369dce43f87ee9a825c6790eb3e8dd5e4531df1643f6049ad56c","observation_id":"b0bec346-0217-440a-9c94-502e42612725","resolution":{"observed_at":"2026-05-11T22:11:14.010147Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:d09348bab7fc06c690316bcfdf6f4805db7f0a712306f730bc3f46f26ebd14ef","observation_id":"aec6227f-8076-41dc-94a9-9d0babd9efd4","resolution":{"observed_at":"2026-05-11T19:31:08.563625Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2605.08930","last_updated":"2026-05-09T13:05:00Z","snapshot_observed_at":"2026-07-06T23:21:06.773761Z","submitted_at":"2026-05-09T13:05:00Z","title":"Internalizing Safety Understanding in Large Reasoning Models via Verification","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-12T01:50:59.283409Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2605.08930"},"observation_digest":"sha256:ea68c05ab4dbc9f94bd786c839483a94e4ba5b9bdabea29e5a9e6f83a8615bc7","observation_id":"27dddf4d-e254-4f60-953b-8ff3632f9d83","resolution":{"observed_at":"2026-05-12T01:51:14.238142Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2605.22771","last_updated":"2026-05-28T14:36:56Z","snapshot_observed_at":"2026-08-02T14:56:42.675689Z","submitted_at":"2026-05-21T17:32:40Z","title":"Reducing Political Manipulation with Consistency Training","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-22T05:32:19.312335Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2605.22771"},"observation_digest":"sha256:0928e8e27d85a8ea4bae5955fcf7b0c2e9d7d2b6e661f9893e76fd0dd409e84a","observation_id":"5d489190-aa42-498a-9084-49fc23f6703c","resolution":{"observed_at":"2026-05-22T05:34:40.233116Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2605.22771","last_updated":"2026-05-28T14:36:56Z","snapshot_observed_at":"2026-08-02T14:56:42.675689Z","submitted_at":"2026-05-21T17:32:40Z","title":"Reducing Political Manipulation with Consistency Training","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-30T16:49:16.542582Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2605.22771"},"observation_digest":"sha256:b359dd218b95cab8d0b6c3c459d0d0ef8f8182a67acd66e16a33300b99995f4e","observation_id":"27d5e496-392f-4511-a39f-bf7b49040453","resolution":{"observed_at":"2026-06-30T16:54:58.727042Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2605.31381","last_updated":"2026-06-02T14:28:06Z","snapshot_observed_at":"2026-08-05T19:10:48.324254Z","submitted_at":"2026-05-29T14:50:08Z","title":"LLM Judges Inconsistently Disagree Across Safety Criteria and Harm Categories","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T22:33:26.600072Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2605.31381"},"observation_digest":"sha256:d2c69c2ac9a0268e0f59f44783658e70d472bdda0551949fbd47ef8e5b3df90b","observation_id":"1a845245-3a9c-46d1-9b9b-cdb20a841c83","resolution":{"observed_at":"2026-07-01T19:26:00.785841Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2606.02423","last_updated":"2026-06-01T16:01:37Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T16:01:37Z","title":"Investigating and Alleviating Harm Amplification in LLM Interactions","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-28T14:31:52.027889Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2606.02423"},"observation_digest":"sha256:9ccc26382fbe58de448319ab14838d698d7dc26226b7db74556c3a65e64008c2","observation_id":"d966b265-c9f3-4000-b32b-f8565878dee3","resolution":{"observed_at":"2026-07-01T23:16:24.040929Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2606.03648","last_updated":"2026-06-02T13:39:17Z","snapshot_observed_at":"2026-08-06T05:56:12.921634Z","submitted_at":"2026-06-02T13:39:17Z","title":"Safety Measurements for Fine-tuned LLMs Should be Grounded in Capability","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-28T10:00:30.904247Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2606.03648"},"observation_digest":"sha256:68225f8e5817306c978381a3015c062428d048b94264a2e0de2c04fd67fe7e0b","observation_id":"fed5df3e-33d3-415e-967a-4a6a64015832","resolution":{"observed_at":"2026-07-02T03:26:29.803972Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2606.30661","last_updated":"2026-06-16T18:48:20Z","snapshot_observed_at":"2026-07-07T00:04:29.879877Z","submitted_at":"2026-06-16T18:48:20Z","title":"Understanding Censorship in Large Language Models: From Mechanisms to Governance","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-01T07:02:35.840261Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2606.30661"},"observation_digest":"sha256:c7039fd14e9a5ac6daa35d00a3a8fee7d78c7469c03de03442b81e22a612e946","observation_id":"28e34803-b869-4ca7-93d5-9fb1e5c85b01","resolution":{"observed_at":"2026-07-01T07:05:28.397555Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2607.02047","last_updated":"2026-07-02T11:14:52Z","snapshot_observed_at":"2026-08-05T00:28:59.014764Z","submitted_at":"2026-07-02T11:14:52Z","title":"OpenSafeIntent: Evaluating Intent-Calibrated Safe Completion Across Dual-Use Prompt Sets","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-03T14:44:57.205766Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2607.02047"},"observation_digest":"sha256:3b275f0f78e00ab14cf68ad75049b8cc02f096a27eec56d54efe59c8fbdc31b8","observation_id":"8032e4dd-60b3-47f1-a891-572cd3fd65ad","resolution":{"observed_at":"2026-07-03T14:48:32.496890Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-07-12T06:11:38.403281Z","title":"From hard refusals to safe-completions: Toward output-centric safety training.arXiv preprint arXiv:2508.09224, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02914","last_updated":"2026-07-03T03:19:39Z","snapshot_observed_at":"2026-08-06T07:16:16.960857Z","submitted_at":"2026-07-03T03:19:39Z","title":"Oyster-II: Reinforcement Learning for Constructive Safety Alignment in Large Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-12T06:11:38.403281Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2607.02914"},"observation_digest":"sha256:9517afe2b56eef5fa4a805ee0b6fbcdca81b8614b4be8065f131534c083d52cd","observation_id":"13e43977-b44e-4383-bfa6-66195151621c","resolution":{"observed_at":"2026-07-12T06:11:38.403281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-01T01:12:44.184834Z","title":"Yu,J.,Lin,X.,Yu,Z.,andXing,X","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.26115","last_updated":"2026-07-28T16:03:39Z","snapshot_observed_at":"2026-08-03T09:49:36.555011Z","submitted_at":"2026-07-28T16:03:39Z","title":"GPT-Red: Automated Red Teaming via Self-Play at Scale","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T01:12:44.184834Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2607.26115"},"observation_digest":"sha256:7fabcea4add8efe70c7e5770724018312883437396a81187dea6fd395a13cc5e","observation_id":"b3b09427-a1e8-4a06-a09e-bb0a28d19412","resolution":{"observed_at":"2026-08-01T01:12:44.184834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-01T00:35:58.478085Z","title":"arXiv preprint arXiv:2508.09224 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26200","last_updated":"2026-07-28T19:05:24Z","snapshot_observed_at":"2026-08-06T04:28:56.547272Z","submitted_at":"2026-07-28T19:05:24Z","title":"Choosing Where and How to Moderate: End-to-End Trade-offs in Filter Placement and Response Rewriting","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-01T00:35:58.478085Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2607.26200"},"observation_digest":"sha256:82958c3ebe88645b0fce98501e8937d603e9b1ad56d6712d325ac9498f4b7b1e","observation_id":"3a138c4e-30e0-4b6a-8e2f-7bead74052f4","resolution":{"observed_at":"2026-08-01T00:35:58.478085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-07-31T22:25:22.224180Z","title":"arXiv preprint arXiv:2508.09224 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27951","last_updated":"2026-07-30T09:59:08Z","snapshot_observed_at":"2026-08-02T23:47:48.190338Z","submitted_at":"2026-07-30T09:59:08Z","title":"Safeguards Based on Copyable Context Cannot Provide Reliable Safety for LLMs","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-31T22:25:22.224180Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2607.27951"},"observation_digest":"sha256:01314c361f2e6d002dd70b5e4d53bd4d017e782b7927a39de3faab8cfaa25bdb","observation_id":"9486a6b5-410d-471b-afd1-06341419d6b5","resolution":{"observed_at":"2026-07-31T22:25:22.224180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.09224/citation-record","integrity":"/paper/2508.09224/integrity","json":"/paper/2508.09224/citation-record.json","paper":"/paper/2508.09224"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.02151","last_updated":"2025-04-17T18:55:45Z","snapshot_observed_at":"2026-07-06T17:54:43.685212Z","submitted_at":"2024-04-02T17:58:27Z","title":"Jailbreaking Leading Safety-Aligned LLMs with Simple Adaptive Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02151","snapshot_observed_at":"2026-08-05T21:35:33.950466Z","title":"Conference on Language Modeling(2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T21:35:33.950466Z"},"links":{"cited_paper":"/paper/2404.02151","citing_paper":"/paper/2508.09224"},"observation_digest":"sha256:2b707a233fa31e27375855579eff64e2165ad0c5d734deef1d50ab07acb4006a","observation_id":"6fae85d6-77d2-416f-8c51-c429779c4d98","resolution":{"observed_at":"2026-08-05T21:35:33.950466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:35:34.834620Z","title":"[14]OpenAI","venue":null,"work_id":"a19edb6f-a8e2-442a-b5df-a10f4fd40367","year":2025},"citing_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T21:35:34.366680Z"},"links":{"citing_paper":"/paper/2508.09224"},"observation_digest":"sha256:5e03c64c234ec9a647359d2b8d1320552123afec269de593ae4353045f1dc6ea","observation_id":"f2be2c8c-8ac3-4957-8e84-5c49decdb846","resolution":{"observed_at":"2026-08-05T21:35:34.923470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01263","last_updated":"2024-04-01T11:50:35Z","snapshot_observed_at":"2026-08-03T00:58:55.865010Z","submitted_at":"2023-08-02T16:30:40Z","title":"XSTest: A Test Suite for Identifying Exaggerated Safety Behaviours in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01263","snapshot_observed_at":"2026-08-05T21:35:34.494480Z","title":"InAdvances in Neural Information Processing Systems(2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T21:35:34.494480Z"},"links":{"cited_paper":"/paper/2308.01263","citing_paper":"/paper/2508.09224"},"observation_digest":"sha256:5834b402aa7d1a2bcaf0925a3bb52bd6034489c54f290821c419ca7ac0b7ffb7","observation_id":"81b07747-e930-4ec7-94d4-ab893594fb53","resolution":{"observed_at":"2026-08-05T21:35:34.494480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-05T21:35:34.096588Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-05T21:35:34.096588Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2508.09224"},"observation_digest":"sha256:5c52f6a705337a75da4f6539ed7e36609bd465e51ff5f7ffd7a5ddc1a03dddae","observation_id":"9c3d15c9-ca69-4187-af43-76ddc9f34c93","resolution":{"observed_at":"2026-08-05T21:35:34.096588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-05T21:35:34.616461Z","title":"highly actionable instructions on evading law enforcement or facilitating theft","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T21:35:34.616461Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2508.09224"},"observation_digest":"sha256:973d8f5b92b4da8e5f6c471ae5650683015932d901dab83fd76ef79015beb963","observation_id":"e05cc146-80ba-4697-b710-292789aa3a39","resolution":{"observed_at":"2026-08-05T21:35:34.616461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T21:35:34.168865Z","title":"[12]OpenAI","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T21:35:34.168865Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2508.09224"},"observation_digest":"sha256:4057f8e7ed449166afb273b806a0884090df68ddab527703d653e20787f72070","observation_id":"9a63e92e-2b3c-4b20-afb6-6ea4a7b1b4db","resolution":{"observed_at":"2026-08-05T21:35:34.168865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","latest_version":1,"primary_category":"cs.CY","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training"},"reference_resolution":{"displayed":6,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":6},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 6 of 6 outbound references and 20 inbound Pith citation observations for arXiv:2508.09224."}