{"as_of":"2026-08-21T14:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cc87878a0263553dce32bc9a790a1d066c5e911cb3df5fc87dd97d1710f3352d","coverage":[{"denominator":74,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":74,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:48:09.637499Z","state":"measured"},{"denominator":77,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":77,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:05:50.798330Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T07:16:54.724748Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.12038","snapshot_observed_at":"2026-08-15T22:05:50.798330Z","title":"Safe delta: Consistently preserving safety when fine-tuning LLM s on diverse datasets","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.08266","last_updated":"2025-06-06T09:03:54Z","snapshot_observed_at":"2026-08-16T15:49:16.999854Z","submitted_at":"2025-05-13T06:32:23Z","title":"Open Your Eyes: Vision Enhances Message Passing Neural Networks in Link Prediction","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T22:05:50.798330Z"},"links":{"cited_paper":"/paper/2505.12038","citing_paper":"/paper/2505.08266"},"observation_digest":"sha256:f3187363d0c2297b82c99a2a154fe0afbc8c2157da195ac2fa7dcadd0af1ddc9","observation_id":"9df8334b-e98c-4196-b3b4-0d0ce55f9688","resolution":{"observed_at":"2026-08-15T22:05:50.798330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"cited_work":{"arxiv_id":"2505.12038","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.12038","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Yun Luo, Zhen Yang, Fandong Meng, Yafu Li, Jie Zhou, and Yue Zhang","venue":null,"work_id":"015beec1-ef8c-498e-b31d-6aac9a194992","year":2023},"citing_paper":{"arxiv_id":"2604.17215","last_updated":"2026-04-19T02:52:33Z","snapshot_observed_at":"2026-08-14T23:39:28.865116Z","submitted_at":"2026-04-19T02:52:33Z","title":"Continual Safety Alignment via Gradient-Based Sample Selection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T07:16:53.472918Z"},"links":{"cited_paper":"/paper/2505.12038","citing_paper":"/paper/2604.17215"},"observation_digest":"sha256:c3a1df243bb5fbad8ff963257f19ce85683c694dd2e187932a9cbfc4d83c2931","observation_id":"aa548b6b-122a-4a6b-80d2-7e615c384983","resolution":{"observed_at":"2026-05-10T07:16:54.726087Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.12038","snapshot_observed_at":"2026-08-02T10:00:09.737616Z","title":"Safe delta: Consistently preserving safety when fine-tuning llms on diverse datasets,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16242","last_updated":"2026-06-26T03:29:59Z","snapshot_observed_at":"2026-08-20T14:27:00.969980Z","submitted_at":"2026-06-26T03:29:59Z","title":"TRACE: Trajectory-Based Safety Patch Learning for LLM Post-Training Realignment","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T10:00:09.737616Z"},"links":{"cited_paper":"/paper/2505.12038","citing_paper":"/paper/2607.16242"},"observation_digest":"sha256:0f69a6c9a017926786fbe2c4a442994ec992fe56c960d6b8f29e073b4d372bef","observation_id":"1ad72020-6449-47aa-a97c-2bb7e0eae2e0","resolution":{"observed_at":"2026-08-02T10:00:09.737616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.12038/citation-record","integrity":"/paper/2505.12038/integrity","json":"/paper/2505.12038/citation-record.json","paper":"/paper/2505.12038"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.358653Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.358653Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:33fb5866c3a689b705be3cfd7d962b58047881b12abcfa304855cda3b232fdec","observation_id":"06ffc698-e179-4fb5-922c-d448b4db6be2","resolution":{"observed_at":"2026-08-15T20:48:09.358653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.548140Z","title":"L., Almeida, D., Altenschmidt, J., Altman, S., Anadkat, S., et al","venue":null,"work_id":"e0afa91e-d244-4033-8785-79a1cc2ed5f4","year":2023},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.363624Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:bed9cfd4dde73c27c51c65da9e61f300fff83fbcfabd806c4a9d76bdef76c37b","observation_id":"46a546d9-51bd-4dad-913a-cf81f75af7fb","resolution":{"observed_at":"2026-08-15T20:48:10.552109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.535752Z","title":"Claude, 2023","venue":null,"work_id":"c4e607c3-33c1-44c4-a63b-a79c7eaa896f","year":2023},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.368392Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:986e3bea103d0bd4d35eb563cd4ecaa70bfd404efb25afe887d76b7470f09ba4","observation_id":"0bdb69e6-d1e0-4f7d-905f-288b38f35958","resolution":{"observed_at":"2026-08-15T20:48:10.539605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.521431Z","title":"A general language assistant as a laboratory for alignment","venue":null,"work_id":"e087ba59-379a-41f8-a0da-e74c225ae6a3","year":2021},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.372621Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:7970be4f5d1b1840ccdeb96c515a346afdada91660166cbf478f24b3b231b0e6","observation_id":"85979a93-d15b-42b4-ae5e-20fe352ef81b","resolution":{"observed_at":"2026-08-15T20:48:10.526647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.510965Z","title":"Constitutional AI: harmlessness from AI feedback","venue":null,"work_id":"49523f76-e4b8-4f0d-8f91-85ed0bb06775","year":2022},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.376420Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:cb841e2435641d9d22c28e83a60c3e53b83693e732cba5d08eddf1d27466a97c","observation_id":"184b9299-358d-45fb-89fb-9c87f5706d87","resolution":{"observed_at":"2026-08-15T20:48:10.514850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.496123Z","title":"D., and Poria, S","venue":null,"work_id":"f33aa5ff-25b2-41fc-86b7-968fee36e4fd","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.380549Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:7f9fba51313fc18efecda31273cd089c5c0e25bc7e2b2d8abb0a37d686cc6c8d","observation_id":"7de6123d-b268-4f9c-8f53-370d9805674e","resolution":{"observed_at":"2026-08-15T20:48:10.502975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.484245Z","title":"Safety-tuned llamas: Lessons from improving the safety of large language models that follow instructions","venue":null,"work_id":"cb8fc380-0075-4419-b875-13bfae6b7b3f","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.384550Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:b00ba71b6a1244ee7fa7ab8e23a6b8adfc17335c9f1a34031d7fd8c762183d9e","observation_id":"38d03236-9914-44df-918c-960d9bfc47f6","resolution":{"observed_at":"2026-08-15T20:48:10.488195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.473658Z","title":"J., and Wong, E","venue":null,"work_id":"0d44ee6a-c189-495a-a1ba-d7ddb750e328","year":2023},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.389520Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:dae44ca43be0ec30773542a3c8bbe75e1cdd74e4c1acdc2647807e9e417a12e2","observation_id":"fa1086ee-255c-4616-a977-f2ea6ed82add","resolution":{"observed_at":"2026-08-15T20:48:10.477575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.461985Z","title":"and Kwok, J","venue":null,"work_id":"6d7de1bb-4224-4411-b987-490183420f8a","year":2022},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.392762Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:ea5672e63dfe1aacc795925eb583b42806d528e09c7fc13235bce8e78b72900a","observation_id":"acd18528-edfc-427c-8929-2722a9c72dca","resolution":{"observed_at":"2026-08-15T20:48:10.465787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.450457Z","title":"and Kwok, J","venue":null,"work_id":"3b153145-0f26-481d-bebf-7d56a239df28","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.396274Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:1b9bef644546de4799ea6cefe5967a3711634fba240645a88dc4cae52f19fe99","observation_id":"e48b2130-7171-4588-98e5-f23f26cb93a0","resolution":{"observed_at":"2026-08-15T20:48:10.454447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.438798Z","title":"and Kwok, J","venue":null,"work_id":"9c5d1556-d1ad-49c4-be4b-992eb8bf9a5f","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.400818Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:d5f14896539f564048003412b67323de8c3ac73fbb4ace41baa58abf920a196e","observation_id":"a5e6fff1-e35f-43c0-a540-53a4dd24305f","resolution":{"observed_at":"2026-08-15T20:48:10.442875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.424217Z","title":null,"venue":null,"work_id":"718fb127-7c4b-41ff-af73-cd967b35f573","year":2025},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.404778Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:3985c309b3ccb98ad507f12f1eb844cb9ebfe5e8297d7986ac7d018418554402","observation_id":"7bfa643f-d42e-46fe-8e9a-1b8f1e72874b","resolution":{"observed_at":"2026-08-15T20:48:10.428658Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.412358Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":"c19183ba-2c08-4f00-83db-5c6ac02d8a2d","year":2021},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.408339Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:edbea0e710b49416370a8699244d0fc4a8c01110d1eb913fbaa379a78c037540","observation_id":"f205107a-4ad6-44de-bda6-b0db28b9257a","resolution":{"observed_at":"2026-08-15T20:48:10.416587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.400367Z","title":"Or-bench: An over-refusal benchmark for large language models","venue":null,"work_id":"9e77ca42-b15f-4155-973c-ecde920ac0ee","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.411823Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:a9a060365d2f0e6f5b10084596630d2020eb2812cbe8526e936ff256904c1c47","observation_id":"2c527ac9-ed9f-4cff-96fa-1d918fb5ad4a","resolution":{"observed_at":"2026-08-15T20:48:10.405043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.388333Z","title":"Safe RLHF: safe reinforcement learning from human feedback","venue":null,"work_id":"a63dfd82-ea5d-4495-9f5f-e329b2e43b6f","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.415521Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:d258c756eb781d1bf55152321ce9ccf4a90adc8636d89166825515f1a26df983","observation_id":"26e499eb-1a8c-4219-a467-bbc9ad733bd2","resolution":{"observed_at":"2026-08-15T20:48:10.392035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.376531Z","title":"and Alistarh, D","venue":null,"work_id":"7adba70a-d457-43c9-a219-8e1d25ad2109","year":2023},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.419624Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:95ed1e06a8179fcb19c73ae8b47ed07a21e85796643d96a728c006287c5df184","observation_id":"1eaf2eb9-2079-4c79-8a6a-f6634c713ea2","resolution":{"observed_at":"2026-08-15T20:48:10.380491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.364417Z","title":null,"venue":null,"work_id":"aa9ff009-90d2-4bf0-9b07-ebaa1f4e77fd","year":2020},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.423208Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:0cce67c095a3a4073a66a2bed5525a8e1b914fc890e6f7d96f21dcf7d3e4e722","observation_id":"555b25f4-bb92-44bf-8776-8b2c71721910","resolution":{"observed_at":"2026-08-15T20:48:10.368777Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.351405Z","title":"SAMS um corpus: A human-annotated dialogue dataset for abstractive summarization","venue":null,"work_id":"6a03bb34-6b45-48a2-b955-1d505983deee","year":2019},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.426450Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:ad588f3fd01b16fc6f0783c10eafbf40a960c020b8257f36b7e99fedb5dcf894","observation_id":"ea189a60-db91-41a0-8066-3b4fc6fbeb45","resolution":{"observed_at":"2026-08-15T20:48:10.356192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.337223Z","title":"T., Zhang, Y., and Wang, M","venue":null,"work_id":"b7abed3f-00aa-4dfa-883c-56247778f5fb","year":2023},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.429657Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:b26af9c686c0cf2564b9d93b313cd63133c5d05fd649bd45ff8b6aaad49a9e46","observation_id":"95789653-7df5-420e-a3fe-1b82bde2546f","resolution":{"observed_at":"2026-08-15T20:48:10.341288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.324599Z","title":"T., and Zhang, Y","venue":null,"work_id":"46f889c4-fd1f-4833-a5b5-b251ebc23760","year":2023},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.432919Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:058356a7d7316a7f2da859e0baf0697895fa4a3f76026d456ecd711f47464e3b","observation_id":"a6018676-ad8c-484c-aaa9-0ac424d8ea63","resolution":{"observed_at":"2026-08-15T20:48:10.329363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.311614Z","title":"T., and Zhang, Y","venue":null,"work_id":"e4085f1a-6b43-4fde-8a7c-ec24243992cb","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.436469Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:0f72f07e58af376600d228f92d84ab189d7c8e619a578ec2469eafe9403bc71c","observation_id":"5e4fff59-0fa7-4b7a-9903-576cdf5403ed","resolution":{"observed_at":"2026-08-15T20:48:10.315625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.296844Z","title":"The llama 3 herd of models","venue":null,"work_id":"45120892-a841-41da-8139-c72b7645e501","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.440527Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:b26ee121af3d3548d055e22d6da2d34dd202842526680b8eca755e5bd04793a0","observation_id":"43cd4c80-b192-454f-8046-bc851f89d9f0","resolution":{"observed_at":"2026-08-15T20:48:10.301025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.284101Z","title":"and Stork, D","venue":null,"work_id":"44cbdd3c-9e49-4614-9634-669c7d089156","year":1992},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.444165Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:77502af0cdad0410306f51959b6c8a87022235da1331a72d386f5b5a6e8720ea","observation_id":"720004a4-0041-4c7b-8616-21c82f81bc20","resolution":{"observed_at":"2026-08-15T20:48:10.287671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.448267Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.448267Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:a67cd103eada1c1202eba02d6ba2b7f7a8330da648cd759b6cac9400fdb38800","observation_id":"7ba6578d-84b8-4c50-9955-cce397c50853","resolution":{"observed_at":"2026-08-15T20:48:09.448267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.265183Z","title":"Safe lo RA : The silver lining of reducing safety risks when finetuning large language models","venue":null,"work_id":"9e07f929-4cb1-4f89-a979-b23f90c589c4","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.451877Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:c80d51a29cca65c46335edb051cfc89be1100caad1cfd1f82dba695c5a7a35d9","observation_id":"d2ad24bc-93d6-47fc-b0a2-dddc0226617e","resolution":{"observed_at":"2026-08-15T20:48:10.269461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.456931Z","title":"J., Shen, Y., Wallis, P., Allen - Zhu, Z., Li, Y., Wang, S., Wang, L., and Chen, W","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.456931Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:02a9396794e125769c48dc53b648fcb8e3a89caaba428db53d64f98010c48253","observation_id":"d72c5881-5d81-4354-8c44-a7ef961ce7f0","resolution":{"observed_at":"2026-08-15T20:48:09.456931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.245731Z","title":"Antidote: Post-fine-tuning safety alignment for large language models against harmful fine-tuning","venue":null,"work_id":"302fbbae-3a3d-4ed3-82c0-025b440d11db","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.461037Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:f5d64f7ed6c7ef14daf0c2a88c13b43ab41f16a18f26142c21315e9acfe0e8ec","observation_id":"76a65fbe-7c41-4701-9911-e6b59e03fef1","resolution":{"observed_at":"2026-08-15T20:48:10.250159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.234581Z","title":"F., and Liu, L","venue":null,"work_id":"acbdb079-b424-4bff-b5e5-5e4ae72183aa","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.465090Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:bfed86489049ceba0b0b31829f3f1d41a50dc052933bdb808ae62ed91a378288","observation_id":"9b612919-b420-4318-b7e0-a888c7aa8687","resolution":{"observed_at":"2026-08-15T20:48:10.238480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.220125Z","title":"F., and Liu, L","venue":null,"work_id":"f795436d-7c79-4bfb-8693-1621bb3c45bf","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.468662Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:94f7fdb45d2b48c0b16f6aa2bbd4dc32568895023801a97e8149edadf68524f0","observation_id":"eafd6c8f-d5e5-4ab3-b7f8-2ee15ab700fe","resolution":{"observed_at":"2026-08-15T20:48:10.224298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.207477Z","title":"Vaccine: Perturbation-aware alignment for large language models against harmful fine-tuning attack","venue":null,"work_id":"fdd6bf78-860d-4c1d-b2af-98ea31f1fb32","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.471997Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:4d19dd8b55f6b9a1ab09aed9ec308ef32915159a5742dc107ad5ea9e50b61463","observation_id":"421020db-c577-4b03-a1a5-a29f28011a67","resolution":{"observed_at":"2026-08-15T20:48:10.211907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.186650Z","title":"F., and Liu, L","venue":null,"work_id":"db86c8de-5d61-4b32-bc1e-6544e89ca2c5","year":2025},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.475759Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:2af6da7e403db69ae0bf5b7965e39df54920fa0fb53ea0a2980f819935e0c5e8","observation_id":"d2f37b53-3550-42a9-afb8-42fd5393194d","resolution":{"observed_at":"2026-08-15T20:48:10.191379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.168946Z","title":"Catastrophic jailbreak of open-source llms via exploiting generation","venue":null,"work_id":"c90aae1e-1a72-46c7-887f-c1abb82b9b65","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.479732Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:c4f3ef27fb93e2ff84e4e41d95b177280c6596e7bdb4addb527c5a2d71999d3d","observation_id":"5cbf0e13-88cc-474e-ab1c-1ab6cdcd4e31","resolution":{"observed_at":"2026-08-15T20:48:10.175610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.157429Z","title":"Accurate post training quantization with small calibration sets","venue":null,"work_id":"bb3ac660-9374-476f-8019-6d146b545827","year":2021},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.483714Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:a715a1354b1d387a974d8e4b68da8603c69b3d42eb2f2764519a476d72887bfc","observation_id":"cab5168c-3bb7-448f-af79-b83b531848be","resolution":{"observed_at":"2026-08-15T20:48:10.161514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.145713Z","title":"Beavertails: Towards improved safety alignment of LLM via a human-preference dataset","venue":null,"work_id":"d577a6f1-01c5-4ae8-96f2-f24d4f187ce2","year":2023},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.487369Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:a01bc96edbeeef8cfd21ebc9a4b79295c0c33cb554d72f03ccf22daf18412474","observation_id":"85ff3f11-f9ff-41bc-ac49-f9539ff67c26","resolution":{"observed_at":"2026-08-15T20:48:10.149895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.132566Z","title":"S., and Solla, S","venue":null,"work_id":"9cff5ee6-7806-48d6-9dd9-cfcad674a185","year":1989},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.491331Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:b29cf5d861ab91143b7a03f97dfd7fb0672360a649ec2c7c31d638c64f49b09e","observation_id":"37b644d9-66d7-4628-8751-8769ea7c72f7","resolution":{"observed_at":"2026-08-15T20:48:10.136499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.494983Z","title":"Rouge: A package for automatic evaluation of summaries","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.494983Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:029a9ae01293274a6477a14c8d19da5efdfbd5ed2036a83ed78a665fd27766b2","observation_id":"c547a46f-67bd-4ed5-a71e-ed0338aa9c0b","resolution":{"observed_at":"2026-08-15T20:48:09.494983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.107270Z","title":"Efficient combinatorial optimization for word-level adversarial textual attack","venue":null,"work_id":"5452cbca-abae-4360-86a0-808b644e64fc","year":2022},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.499142Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:2dc8c43c348e9eb3ec549f5dcb82acff392a8bd45b39bce0e148bd22d87c3f6c","observation_id":"b2a75962-a90a-488e-b8fe-e3766bde06ed","resolution":{"observed_at":"2026-08-15T20:48:10.112619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.090935Z","title":"Effective and imperceptible adversarial textual attack via multi-objectivization","venue":null,"work_id":"e524cf43-7164-46e4-9d07-b9ace5747550","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.503233Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:7833315c2ca8fddffc99dc3cdeb744f6952d681bfb69f4a45f3a1f7dcc556958","observation_id":"cc8ff391-bddf-4cd1-84ac-f3792dc28994","resolution":{"observed_at":"2026-08-15T20:48:10.095666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.077656Z","title":"Autodan: Generating stealthy jailbreak prompts on aligned large language models","venue":null,"work_id":"720f06bb-7dd1-4561-9071-8d204c9aa45d","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.508028Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:8090545533ae01d105680ecd8d62dc5f4299c65a8b7d511e69e46c1ba0aa6fa9","observation_id":"ff741e80-04be-4925-a69e-d9c7d707bc43","resolution":{"observed_at":"2026-08-15T20:48:10.081438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.063282Z","title":"Jailbreaking chatgpt via prompt engineering: An empirical study","venue":null,"work_id":"b5a535c9-d4bf-4079-92e6-be25f4b5a6b1","year":2023},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.511780Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:e0f193a8e8e1ab1b4057e2bb11e2971567935a20425f6497f5629ccda387e8b3","observation_id":"8a3fce4b-58c4-436d-944e-d3915437abf8","resolution":{"observed_at":"2026-08-15T20:48:10.069156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.515691Z","title":"and Hutter, F","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.515691Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:6e80eef3a4fe5524c3dd11d6d575dc858337dfacb99251f5dba2f961b23e7fff","observation_id":"8ce2d8e3-a788-4de0-b3cf-19b558887bb9","resolution":{"observed_at":"2026-08-15T20:48:09.515691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.044648Z","title":"Large language models can be guided to evade ai-generated text detection","venue":null,"work_id":"6afde9c5-e374-4a08-a9ec-e8fb2b5bccf3","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.519580Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:4e6632882ef06d937c222b126a13c93d4fadcb1e5078e45cecadb2416e1e17d6","observation_id":"1b48d144-5f21-43e5-a36d-da1e2fa5516c","resolution":{"observed_at":"2026-08-15T20:48:10.048517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.033023Z","title":"Less is more: Understanding word-level textual adversarial attack via n-gram frequency descend","venue":null,"work_id":"af960471-dc4d-4628-a969-aba4db4ceb07","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.523814Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:76ebc7142eb94048699a72673528f438437f282f822bb653994af813e7c47698","observation_id":"12f0d60f-a0a8-4de2-8900-5d89404a427b","resolution":{"observed_at":"2026-08-15T20:48:10.036850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.018171Z","title":"Training overhead ratio: A practical reliability metric for large language model training systems","venue":null,"work_id":"21a5dea6-22af-45d0-a33d-2dc5ccc645f8","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.527712Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:7fa9624b7f29a2c530b5c34f27e9bd329ebf62ad28448c34d166ec3fafa3340a","observation_id":"086aa09e-52d0-428c-9a82-d9f5c532ad10","resolution":{"observed_at":"2026-08-15T20:48:10.024008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:10.004272Z","title":null,"venue":null,"work_id":"b7028233-4fef-4b8e-8f19-339e64c12238","year":2017},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.531460Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:111fc4fde12847890e219c16a2d422da29e1baf0960962724794748bd88a8eca","observation_id":"5c5d159b-7570-46a2-934a-4c80b0ceaf2b","resolution":{"observed_at":"2026-08-15T20:48:10.009449Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.534885Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.534885Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:fb5cc2bb8d23693a9e0cbf832202ad9cf51819ec310f0b0d40155d1931b7f1fe","observation_id":"baa0e1a6-2158-4c23-be02-da1a495353e6","resolution":{"observed_at":"2026-08-15T20:48:09.534885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.985796Z","title":"Fine-tuning now available for gpt-4o, 2024","venue":null,"work_id":"7f8b3885-1d23-4f5b-bd67-8397bd831598","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.538573Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:2127b89038a3c9e3d7040148b185e30dfe1ea2e41b0f6a8be0a57ca31769caa9","observation_id":"89f38a6a-2757-427a-ac4d-a5f79d4df568","resolution":{"observed_at":"2026-08-15T20:48:09.989266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.975640Z","title":"Instruction tuning with GPT-4","venue":null,"work_id":"487794d2-4a73-41b4-8f9b-2c03e8066082","year":2023},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.542032Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:07ca3f95d53a07578f948ea12f761f4b54a3d268af1f89c3a55c12255320c44a","observation_id":"c5cc1688-fbb6-4376-9516-d02af1e946e6","resolution":{"observed_at":"2026-08-15T20:48:09.979184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.964045Z","title":"Fine-tuning aligned language models compromises safety, even when users do not intend to! In The Twelfth International Conference on Learning Representations, 2024","venue":null,"work_id":"992bf308-ae2f-43df-9b15-370b0c2ac915","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.545866Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:fbe0ded16e99fd1e1fea2862b1cea19ef6475cead79eb9aa1982f9167b49d90f","observation_id":"3409dd57-7632-4bc2-a924-08eab1087789","resolution":{"observed_at":"2026-08-15T20:48:09.968712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.951493Z","title":"D., Ermon, S., and Finn, C","venue":null,"work_id":"22ebe4b8-e6b8-4066-a303-5941e66cd119","year":2023},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.549437Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:a52a5a53af9bb2a3f2348f4ed190e9ae257ae4007c5d8d80395fbb173f2ae399","observation_id":"1f14dfad-4f74-48a4-85cf-db3325442932","resolution":{"observed_at":"2026-08-15T20:48:09.955652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.937922Z","title":"Modelgrow: Continual text-to-video pre-training with model expansion and language understanding enhancement","venue":null,"work_id":"f0e488b7-4eec-4a82-a445-1df940b67eb7","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.553069Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:2818a0e0e5376f83b05037aa7a62602eb8d450fa61ade675231ecaab6cda1405","observation_id":"3eff96cc-2f75-460d-a807-f4aff180614e","resolution":{"observed_at":"2026-08-15T20:48:09.942964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.923710Z","title":"Representation noising: A defence mechanism against harmful finetuning","venue":null,"work_id":"372c9b26-733f-4ce9-bbf8-ebd80ab347f3","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.556856Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:829e529266a839380ef3411ad85e731cf655abf92a2e2041a8177cdab0a40dd1","observation_id":"50cf077a-867a-4fe9-96a3-029a9f7074d3","resolution":{"observed_at":"2026-08-15T20:48:09.929236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.910826Z","title":null,"venue":null,"work_id":"7017b634-6f95-4200-8d6f-99173817b5f7","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.560333Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:86a9691d68f12130f63b219f91533f6d19911ac4436623db2b3da9fd477f8d1f","observation_id":"febc9c75-3f5d-47de-803c-9ce89aac5cfb","resolution":{"observed_at":"2026-08-15T20:48:09.916189Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.897459Z","title":"do anything now","venue":null,"work_id":"6340982d-367d-4821-a0d9-5926a615c9ff","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.563765Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:a990fa98f400ad91864139dd55da8e08c844b5a3064b51d89e12d66f3098c553","observation_id":"9c59bfa1-d2d5-4804-8972-aa168d140938","resolution":{"observed_at":"2026-08-15T20:48:09.903027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.885843Z","title":"Axiomatic attribution for deep networks","venue":null,"work_id":"d2ca0e73-512f-47ad-8f50-9b61274764d6","year":2017},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.567295Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:383c1d24962d58a885d2de97cf290a062de2b8249cb572c58d23f39455ff098d","observation_id":"b8406427-e273-49eb-b614-0c6f8059cd1e","resolution":{"observed_at":"2026-08-15T20:48:09.889922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6199","last_updated":"2014-02-19T16:33:14Z","snapshot_observed_at":"2026-08-15T16:41:15.505782Z","submitted_at":"2013-12-21T03:36:08Z","title":"Intriguing properties of neural networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6199","snapshot_observed_at":"2026-08-15T20:48:09.570773Z","title":"J., and Fergus, R","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.570773Z"},"links":{"cited_paper":"/paper/1312.6199","citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:6b6fd6f335f5e38fa18f4274b70a17e5f63b1365acef4dea198c5af772c6cf12","observation_id":"91529f78-8d93-485c-9738-0e1c54cd2af4","resolution":{"observed_at":"2026-08-15T20:48:09.570773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.574479Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.574479Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:91e924417fdc93fd87e58060c4b1d016bbd65f6e16ccede6f94d3d46f87a0efb","observation_id":"a816b57d-fada-4e37-aa60-da5529643cde","resolution":{"observed_at":"2026-08-15T20:48:09.574479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.866050Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":"212cdc33-82fe-496f-bde3-ae46d220b12e","year":2023},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.577567Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:f184ad495692d1f4a07261c4597003254279403a240ee3873f3f308492d6e1f4","observation_id":"8cfe80fa-a50d-485d-af6d-e2df5fa984af","resolution":{"observed_at":"2026-08-15T20:48:09.870472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.854490Z","title":"Backdooralign: Mitigating fine-tuning based jailbreak attack with backdoor enhanced safety alignment","venue":null,"work_id":"6ab767b6-dadb-4519-9484-1ad188a8ba91","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.580553Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:e0961d9d63ab7689e6e5857f376795d0322f3af69d0131ce00d381b747c2af59","observation_id":"5469cc26-d445-4d2f-afe1-f8c12451fa4d","resolution":{"observed_at":"2026-08-15T20:48:09.858553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.584046Z","title":"W., Lester, B., Du, N., Dai, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.584046Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:1ae4f1c5119adbf97bc8afbaed8d8d5f484e8b5aa7aeb4423a9ca41e294a888a","observation_id":"4bbcd51a-bee2-4bd9-86d6-e7f46c1013ad","resolution":{"observed_at":"2026-08-15T20:48:09.584046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.836435Z","title":null,"venue":null,"work_id":"6fcbff81-6fee-42f4-b2eb-da60b9c0b539","year":2023},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.587511Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:2fe632ad07fc920a13d3b25ee446014f9b6d99f8e88ec6ebaccb8c61967e7d66","observation_id":"34a1d094-073c-4a9d-947a-7c08c09d0c42","resolution":{"observed_at":"2026-08-15T20:48:09.840610Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.824283Z","title":"T., and Zhang, Y","venue":null,"work_id":"2f2cc640-7f35-4cb8-b3b3-c6a708463626","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.591061Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:424922d9880276c1cbe2c53ce184559c381e15db61db2c4122e7c3dbfbfb7d88","observation_id":"ca1bf601-9710-4d28-a6e5-d615025475f9","resolution":{"observed_at":"2026-08-15T20:48:09.828375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.812528Z","title":"Open the eyes of mpnn: Vision enhances mpnn in link prediction, 2025","venue":null,"work_id":"3350df7f-1593-4735-92f2-156e1807c9dc","year":2025},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.594549Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:9d932e821ee7d72e405941c75282022074e79ec0e3309d3edc2d50bceb659f5f","observation_id":"e111a9b0-e93e-441d-9842-e85a989af69c","resolution":{"observed_at":"2026-08-15T20:48:09.816424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.800401Z","title":"Backdoor graph condensation","venue":null,"work_id":"c92519dc-4483-4d1c-983c-0191a527ba7a","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.598759Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:f259df3db147d56bd0d4a39ef8d8e78d6f9988cf6390a6c0561526ab2a247255","observation_id":"4352e134-1c60-455a-b689-5b751316a200","resolution":{"observed_at":"2026-08-15T20:48:09.804801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.786296Z","title":"Tf-dcon: Leveraging large language models (llms) to empower training-free dataset condensation for content-based recommendation, 2025","venue":null,"work_id":"b1b7d2b4-4e97-4e96-92e2-d49a17b04897","year":2025},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.604127Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:839c691997934f42274106e0d0abbe3e550512d0f88e3b31f6dff3bb7033833a","observation_id":"f0d71694-5392-408c-9660-75b5f1c6470b","resolution":{"observed_at":"2026-08-15T20:48:09.790900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.773789Z","title":"RLCD: reinforcement learning from contrastive distillation for LM alignment","venue":null,"work_id":"967a357e-32cf-490c-b4dd-dd90d3315b16","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.608118Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:de2c3e9615d4e263e01ec09e31a4ecb67c7d04d694aee59c4b17765e5dc10c55","observation_id":"00bc88b6-1acf-4493-aa6b-e2118a33cd38","resolution":{"observed_at":"2026-08-15T20:48:09.778858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.762280Z","title":"Y., Zhao, X., and Lin, D","venue":null,"work_id":"2dec3a4f-b7b4-43db-ab3c-295273c49ecf","year":2023},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.612215Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:6b18985ef44ab5b060b08ba3896006d7ea54592f5a22c277e8a155d3e43f6814","observation_id":"1bc3c7b1-5acf-445b-969f-027fc208a9e9","resolution":{"observed_at":"2026-08-15T20:48:09.765742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.751801Z","title":"NLSR: neuron-level safety realignment of large language models against harmful fine-tuning","venue":null,"work_id":"5fb01bbf-58b7-4d44-bb7a-e0a18fdf1fca","year":2025},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.616258Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:7d183145a78360890d0f2e31ebf1d5d6981add6119aa87210a4cb11e7962f2ba","observation_id":"e73d58be-004b-41e2-8c42-1806d6eac4fb","resolution":{"observed_at":"2026-08-15T20:48:09.755306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.740856Z","title":null,"venue":null,"work_id":"cf2bd899-25df-4dfd-905d-83eba6fd242c","year":2023},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.620062Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:a5b769c3e59160834477b4d37e3bea89641f06d91c3caba15806e51127d9b1f7","observation_id":"7e91603c-a9ac-456e-83f9-cd977e6019ac","resolution":{"observed_at":"2026-08-15T20:48:09.744809Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.729910Z","title":"GPT-4 is too smart to be safe: Stealthy chat with llms via cipher","venue":null,"work_id":"3b1aa412-74f6-44d6-8d96-9a16b212c702","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.623682Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:83ee827d5be9956faf900e07e64963e195c22281d60fe80fe103c1a349b9855d","observation_id":"c731b779-da08-4469-8551-bb95f636ea28","resolution":{"observed_at":"2026-08-15T20:48:09.733690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.717236Z","title":"Removing RLHF protections in GPT-4 via fine-tuning","venue":null,"work_id":"b2d31860-8f4d-46a8-9d9e-c8e7c9036d1b","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.627432Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:20d27690e764b50d2ef749b35d0d7eed03d8fcb8abc7d7bbdc1661087183c5af","observation_id":"86e8a6a8-443d-4d40-beb8-24f16c2d4e51","resolution":{"observed_at":"2026-08-15T20:48:09.722035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.705604Z","title":"P., Zhang, H., Gonzalez, J","venue":null,"work_id":"fb5134b6-4d53-4b27-97e7-d8a6eaf52057","year":2023},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.630723Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:53639cd7637d2d34871bd50fe097fc6c965534aa6a88026975091b6fd2195084","observation_id":"648c4e5a-e75e-4bf7-82f3-634c0cf6e84d","resolution":{"observed_at":"2026-08-15T20:48:09.709539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.691932Z","title":"Model tailor: Mitigating catastrophic forgetting in multi-modal large language models","venue":null,"work_id":"f4a94e8e-4d83-4991-a4ad-bdd747226d96","year":2024},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.633974Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:6f2f103dd61458485d29f344526cba92e712aa2e9e1e8712f0d7aff226d0a963","observation_id":"70f4184b-93f8-4cff-b3e4-157072b49626","resolution":{"observed_at":"2026-08-15T20:48:09.696452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:48:09.679121Z","title":"Z., and Fredrikson, M","venue":null,"work_id":"50d72dce-ce29-4dea-b696-ece56f39a9b3","year":2023},"citing_paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-15T20:48:09.637499Z"},"links":{"citing_paper":"/paper/2505.12038"},"observation_digest":"sha256:0069ec0fe0e89274a0703f7fa5f15269f659e9a456dffd665fac4970ce5c95f6","observation_id":"e0e6b709-8b36-48fe-a6fc-0777aea92182","resolution":{"observed_at":"2026-08-15T20:48:09.683985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.12038","last_updated":"2025-05-17T15:01:07Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T20:40:03.639193Z","submitted_at":"2025-05-17T15:01:07Z","title":"Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets"},"reference_resolution":{"displayed":74,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":59},"total_outbound_references":74},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 74 of 74 outbound references and 3 inbound Pith citation observations for arXiv:2505.12038."}