{"as_of":"2026-08-08T05:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:df4604d46c66656243cd9dd88a6d5bb2db3e7d847ef4cf6d23092148a2006fae","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:58:32.629027Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T21:01:25.549340Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T21:05:04.110492Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2506.03850","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.03850","snapshot_observed_at":"2026-06-30T21:05:04.110492Z","title":"Vulnerability-aware align- ment: Mitigating uneven forgetting in harmful fine-tuning.arXiv preprint arXiv:2506.03850, 2025","venue":null,"work_id":"4f4296f6-92cb-4999-a868-19efb75651b2","year":2025},"citing_paper":{"arxiv_id":"2605.14605","last_updated":"2026-05-24T08:34:13Z","snapshot_observed_at":"2026-07-06T23:25:58.895612Z","submitted_at":"2026-05-14T09:22:14Z","title":"One Step to the Side: Why Defenses Against Malicious Finetuning Fail Under Adaptive Adversaries","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T21:01:25.549340Z"},"links":{"cited_paper":"/paper/2506.03850","citing_paper":"/paper/2605.14605"},"observation_digest":"sha256:bf6472db6d0535950994c6115ad0c5f7999f5f32ad98df905a984a6fc77761a7","observation_id":"7f15e16c-f8f7-4280-8880-d2d3f12f7f79","resolution":{"observed_at":"2026-06-30T21:05:04.112067Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2506.03850","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.03850","snapshot_observed_at":"2026-06-30T21:05:04.110492Z","title":"Vulnerability-aware align- ment: Mitigating uneven forgetting in harmful fine-tuning.arXiv preprint arXiv:2506.03850, 2025","venue":null,"work_id":"4f4296f6-92cb-4999-a868-19efb75651b2","year":2025},"citing_paper":{"arxiv_id":"2605.28030","last_updated":"2026-05-27T06:36:22Z","snapshot_observed_at":"2026-08-07T03:38:26.044946Z","submitted_at":"2026-05-27T06:36:22Z","title":"SPARD: Defending Harmful Fine-Tuning Attack via Safety Projection with Relevance-Diversity Data Selection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T13:49:56.311711Z"},"links":{"cited_paper":"/paper/2506.03850","citing_paper":"/paper/2605.28030"},"observation_digest":"sha256:aae6c5c7849d35b6f8c438fd84a7e72b5114ec4e661e7e8cfa93297c84ea86b5","observation_id":"485d1a7f-70e7-45c9-800c-5887115546fb","resolution":{"observed_at":"2026-06-29T13:53:28.667357Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.03850/citation-record","integrity":"/paper/2506.03850/integrity","json":"/paper/2506.03850/citation-record.json","paper":"/paper/2506.03850"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:27.960888Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:27.960888Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:742ba4567e9a646e6fc15bab9c09fdaae32a04744a1af24d8c0a8a96dbf8463c","observation_id":"85be4b79-7bc6-4a4b-8739-558370a5ff14","resolution":{"observed_at":"2026-08-07T10:58:27.960888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:28.049879Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:28.049879Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:0c8710c38d03f3f941e5d416b6877aec41eeb119183b3d7782d9a4770eb03273","observation_id":"9201a311-3786-4f57-8a1a-d464c3807d6d","resolution":{"observed_at":"2026-08-07T10:58:28.049879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:35.719389Z","title":"D., Melenberg, B., and Rennen, G","venue":null,"work_id":"c3626f88-4382-48ae-ac6f-28611d430cbf","year":2013},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:28.166245Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:57aaea169260f0ba3c3435d2ac00a008118d69e126d25a7a66777a70bfe96d41","observation_id":"07745fbe-1cc1-4cbb-8cb0-60878b663edb","resolution":{"observed_at":"2026-08-07T10:58:35.806351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:35.535844Z","title":"Curriculum learning","venue":null,"work_id":"4ea625cf-c772-4cae-81a9-f9207b8113f8","year":2009},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:28.274612Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:917916f4560814efc2bf7b06b07419865a2e58e3714ebb399dd6dea8a2d2f51e","observation_id":"979dc913-5965-452a-ab2f-f847184f2920","resolution":{"observed_at":"2026-08-07T10:58:35.617713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:28.349795Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:28.349795Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:332d82a8818ee7c94660837947a16ac6333b100310b60ffba10d00ab4e28858a","observation_id":"fc7b2970-884a-458e-87cd-2e018560ef7b","resolution":{"observed_at":"2026-08-07T10:58:28.349795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:28.468902Z","title":"Beyond factuality: A comprehensive evaluation of large language models as knowledge generators","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:28.468902Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:00452c1e40908190c1d5673a0caae3d6ac8fdc65037617cccffa366a4dd6e5b5","observation_id":"1b388d9c-4b5e-4e9b-a117-6132bfe03b9b","resolution":{"observed_at":"2026-08-07T10:58:28.468902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:28.552869Z","title":"W at ME : Towards lossless watermarking through lexical redundancy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:28.552869Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:8f5567af1dc5e8e8e6eb85ff6a9773a733cc721a77ad2f21326438ad285cd823","observation_id":"6b99841c-5412-4628-8e93-984729d3a5e3","resolution":{"observed_at":"2026-08-07T10:58:28.552869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:35.317921Z","title":"Simple permutations can fool LL a MA : Permutation attack and defense for large language models","venue":null,"work_id":"0ac453f5-679b-4db1-894c-61c1a51bad84","year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:28.641840Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:10958bb3bafb3451757faac5f76e5ea394ee3e2fa85d8f7626de88990dd4de61","observation_id":"8d33798b-9766-4add-9d45-ff2fc5d2eb2d","resolution":{"observed_at":"2026-08-07T10:58:35.415083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:35.153154Z","title":"PEARL : Towards permutation-resilient LLM s","venue":null,"work_id":"d3de5b8a-9bca-42e3-a7ff-85c9d7bf69c6","year":2025},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:28.780718Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:cd731b8c1e8c99c92656c71e424b8a5d1efd4f3ee1d35181f78296e4968abe05","observation_id":"c4a364ec-717d-4543-a634-bba1b2c0d6f6","resolution":{"observed_at":"2026-08-07T10:58:35.239385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T10:58:28.922486Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:28.922486Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:f9d185eff499a0455f2a8ea8655bfdfd0568fece125f9b13bf1c35683d21bf45","observation_id":"d4017aa4-c6e8-4a63-893e-37056372c498","resolution":{"observed_at":"2026-08-07T10:58:28.922486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:34.952715Z","title":"Statistics of robust optimization: A generalized empirical likelihood approach","venue":null,"work_id":"30217c79-2d6d-44e8-9e61-f6487e6ee751","year":2016},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:29.035354Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:0321eb9182cec0050d8911179907c527daa0bc8d46a101bdd41155954d038574","observation_id":"ee26b7b9-f979-4f71-b552-d64461331b23","resolution":{"observed_at":"2026-08-07T10:58:35.054218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:34.749932Z","title":"Sharpness-aware minimization for efficiently improving generalization","venue":null,"work_id":"d6029164-d062-486a-8e79-f1f22daf4e82","year":2021},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:29.096459Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:6083963d79513980d9cad9c2d7cd6e127b768c0219a6fc45fcefcab73b877a36","observation_id":"5b6e0b8d-9112-4c43-abf2-31217a9a4b2e","resolution":{"observed_at":"2026-08-07T10:58:34.861219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03342","last_updated":"2022-01-18T23:54:07Z","snapshot_observed_at":"2026-07-06T11:27:01.301532Z","submitted_at":"2021-07-07T16:39:28Z","title":"A Survey of Uncertainty in Deep Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03342","snapshot_observed_at":"2026-08-07T10:58:29.226049Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:29.226049Z"},"links":{"cited_paper":"/paper/2107.03342","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:4db2d9fed166a2e5061c955c9f867fccf8212a4ec54b9ad6cdfb2a5848d130b1","observation_id":"0a7329e2-0b63-40cb-a845-8e5fd7ed970a","resolution":{"observed_at":"2026-08-07T10:58:29.226049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:34.542347Z","title":"Safe lora: the silver lining of reducing safety risks when fine-tuning large language models, 2024","venue":null,"work_id":"e5486d91-584e-45e6-b4e8-28b49c8198a8","year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:29.316371Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:e3f567279f2cbcb3b048f0bf4c2f026f9f4b190303789f19eecd82855c87226b","observation_id":"d79474ea-dfc3-4cb8-9fc8-8c788cb0b3da","resolution":{"observed_at":"2026-08-07T10:58:34.635342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:34.338082Z","title":"Does distributionally robust supervised learning give robust classifiers? In International Conference on Machine Learning (ICML), 2018","venue":null,"work_id":"f90b5790-df40-4431-b8fc-cf9df6785439","year":2018},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:29.426723Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:9f81d059f34bad6fa4f23dd2c9657798d5f5858fc810a8a2a320bde3e3987c3d","observation_id":"3039b9af-f8d2-4aeb-b693-0f6cb6283dd8","resolution":{"observed_at":"2026-08-07T10:58:34.437632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09600","last_updated":"2025-09-05T04:54:29Z","snapshot_observed_at":"2026-07-06T19:02:11.267510Z","submitted_at":"2024-08-18T21:45:03Z","title":"Antidote: Post-fine-tuning Safety Alignment for Large Language Models against Harmful Fine-tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.09600","snapshot_observed_at":"2026-08-07T10:58:29.556438Z","title":"Antidote: Post-fine-tuning safety alignment for large language models against harmful fine-tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:29.556438Z"},"links":{"cited_paper":"/paper/2408.09600","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:2c615c803738e002859c5a1959156ed03618bdd16f4300efbe126aa45c5ed872","observation_id":"5ce7a588-a395-4725-802b-23fa97cb6001","resolution":{"observed_at":"2026-08-07T10:58:29.556438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01586","last_updated":"2025-03-17T17:17:16Z","snapshot_observed_at":"2026-08-05T01:27:27.177475Z","submitted_at":"2024-09-03T03:59:22Z","title":"Booster: Tackling Harmful Fine-tuning for Large Language Models via Attenuating Harmful Perturbation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01586","snapshot_observed_at":"2026-08-07T10:58:29.726809Z","title":"F., and Liu, L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:29.726809Z"},"links":{"cited_paper":"/paper/2409.01586","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:3da6b4042b57ed40e120631c15712b9f0c8dd8585c5c9b82af4716712cadeba0","observation_id":"432e1bfa-79a9-4200-a759-08918ef0de8c","resolution":{"observed_at":"2026-08-07T10:58:29.726809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18641","last_updated":"2024-10-29T05:46:55Z","snapshot_observed_at":"2026-08-07T10:59:20.315271Z","submitted_at":"2024-05-28T22:53:43Z","title":"Lisa: Lazy Safety Alignment for Large Language Models against Harmful Fine-tuning Attack","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18641","snapshot_observed_at":"2026-08-07T10:58:29.862212Z","title":"F., and Liu, L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:29.862212Z"},"links":{"cited_paper":"/paper/2405.18641","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:8af8b1257d643caf8e301282fb5c8673ce182fe98be358d4462254f44bf51635","observation_id":"68912f69-44e1-4a26-9e9d-4eccb783f9cf","resolution":{"observed_at":"2026-08-07T10:58:29.862212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01109","last_updated":"2024-11-24T20:09:55Z","snapshot_observed_at":"2026-07-06T17:24:03.237617Z","submitted_at":"2024-02-02T02:56:50Z","title":"Vaccine: Perturbation-aware Alignment for Large Language Models against Harmful Fine-tuning Attack","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01109","snapshot_observed_at":"2026-08-07T10:58:30.014066Z","title":"Vaccine: Perturbation-aware alignment for large language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:30.014066Z"},"links":{"cited_paper":"/paper/2402.01109","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:d991bd5447923f8570fc4058b12c952716443e195d9476260e46f6d26c4d047d","observation_id":"2b67a653-2ba4-40ac-b187-9c56cd80cf82","resolution":{"observed_at":"2026-08-07T10:58:30.014066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:30.125758Z","title":"Beavertails: Towards improved safety alignment of llm via a human-preference dataset","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:30.125758Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:3bda4832ea84bcb8f525b24a044d4c7252007897e5ee5a164fbd1b7bd3e307ee","observation_id":"85e40ba6-bc56-47e8-9791-7ac500928d3a","resolution":{"observed_at":"2026-08-07T10:58:30.125758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:34.168663Z","title":"A watermark for large language models","venue":null,"work_id":"9ff42df0-fd95-4022-8f58-b0160a738909","year":2023},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:30.240558Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:24fbf5fdfb14a25479605e5b5c276e562fbf9b22ae55645b2e93c823871b063e","observation_id":"7b62c561-52f3-42b0-9a61-828f87d4bb22","resolution":{"observed_at":"2026-08-07T10:58:34.258151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:33.965908Z","title":"and Zhou, E","venue":null,"work_id":"81e77852-f1e9-461b-a52c-ae843f209ce6","year":2015},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:30.373584Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:d0216a17e0f99d2500e3637792f8b739084628f01d3358f7e8c31356d34163bb","observation_id":"9045197d-47fa-47bb-aca2-3d50cea61a3d","resolution":{"observed_at":"2026-08-07T10:58:34.043488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:30.489568Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:30.489568Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:eaebfc7494c4c852a9efb812cfc3f4641422f69c98467d8c012a8c30a79585d1","observation_id":"992acd13-9279-4488-99b5-01a2cc5cbbb7","resolution":{"observed_at":"2026-08-07T10:58:30.489568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:30.674810Z","title":"Truthfulqa: Measuring how models mimic human falsehoods, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:30.674810Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:d42f266d82487e0525ce2475e4b0279fc62c15de0bf2c8050df21a7a39b33c53","observation_id":"56a9ff7c-d06a-43d1-a381-a3109563f274","resolution":{"observed_at":"2026-08-07T10:58:30.674810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-07T10:58:30.814159Z","title":"Fixing weight decay regularization in adam","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:30.814159Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:d487e49f439a3943ce0fcb99f84351ea026126375b8a1564feebffde42477e11","observation_id":"51fd9752-942b-42b2-90aa-7a1795e26c32","resolution":{"observed_at":"2026-08-07T10:58:30.814159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18540","last_updated":"2025-01-17T01:43:21Z","snapshot_observed_at":"2026-07-06T17:36:56.979448Z","submitted_at":"2024-02-28T18:23:49Z","title":"Keeping LLMs Aligned After Fine-tuning: The Crucial Role of Prompt Templates","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18540","snapshot_observed_at":"2026-08-07T10:58:30.941185Z","title":"Keeping llms aligned after fine-tuning: The crucial role of prompt templates","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:30.941185Z"},"links":{"cited_paper":"/paper/2402.18540","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:8857574368803e33fb8f33eaf28e2f5b20e85ac041affa31e75fb5923af684ac","observation_id":"4fed7e0f-c7a7-4eb8-808c-4691a40cde4a","resolution":{"observed_at":"2026-08-07T10:58:30.941185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:33.763569Z","title":"Virtual adversarial training: a regularization method for supervised and semi-supervised learning","venue":null,"work_id":"0a965b0e-d649-4f09-a165-24bc6c2a404a","year":2018},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:31.035740Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:79b2b641237a2fca1898e9eaaa222f4a6cbe2f5b6f5c5c1705cb5e20ba23809d","observation_id":"93941efd-55ef-4822-9be0-74563ea52630","resolution":{"observed_at":"2026-08-07T10:58:33.855444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13320","last_updated":"2024-07-01T17:14:27Z","snapshot_observed_at":"2026-07-06T16:10:23.328130Z","submitted_at":"2023-08-25T11:49:51Z","title":"Fine-tuning can cripple your foundation model; preserving features may be the solution","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13320","snapshot_observed_at":"2026-08-07T10:58:31.154739Z","title":"H., and Dokania, P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:31.154739Z"},"links":{"cited_paper":"/paper/2308.13320","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:755553fd72214b069583d9519568f88ed0784d0b08232c2ec20fbb8a98f5b4b3","observation_id":"8aca17d5-d9ff-4695-9543-791e580d92ad","resolution":{"observed_at":"2026-08-07T10:58:31.154739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:31.235844Z","title":"Robust stochastic approximation approach to stochastic programming","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:31.235844Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:3449c6c3f86e7c367878b4738cd8eb784fd5b0c993bc2591a35ec5ef2e1525ba","observation_id":"0899e5f3-95e0-4dfc-9c9b-61cd7d5dd285","resolution":{"observed_at":"2026-08-07T10:58:31.235844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:33.536179Z","title":"Distributionally robust language modeling","venue":null,"work_id":"75450302-7108-4511-99d3-026d32760af3","year":2019},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:31.306031Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:f74499db92c375edf0484c6c91099eab277cabdbaa09a8e1c4f772760a63fdd3","observation_id":"31bf7f29-8d3d-4195-b990-02fa3aec3dd0","resolution":{"observed_at":"2026-08-07T10:58:33.666994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17374","last_updated":"2024-10-30T22:35:59Z","snapshot_observed_at":"2026-07-06T18:20:44.070255Z","submitted_at":"2024-05-27T17:31:56Z","title":"Navigating the Safety Landscape: Measuring Risks in Finetuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17374","snapshot_observed_at":"2026-08-07T10:58:31.384137Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:31.384137Z"},"links":{"cited_paper":"/paper/2405.17374","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:51eb65d0b16e26afd19973949af44f7b774050f3afe9ba089f359163788908e9","observation_id":"ed815a8c-94fe-46df-8523-01939a05d727","resolution":{"observed_at":"2026-08-07T10:58:31.384137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:33.281926Z","title":"Gradient starvation: A learning proclivity in neural networks","venue":null,"work_id":"f002ad20-32eb-4b43-93e9-2f6734b4e33c","year":2021},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:31.471377Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:eef0f7d2a42170c95ec17b8bd939bb5b920b3fc80baa93b8d05d2511e59837ad","observation_id":"e9fa4308-f270-4c84-a1b8-eccdf39237e8","resolution":{"observed_at":"2026-08-07T10:58:33.450064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:33.099126Z","title":"Fine-tuning aligned language models compromises safety, even when users do not intend to! In The Twelfth International Conference on Learning Representations, 2024","venue":null,"work_id":"e8402c95-bae5-4473-a16a-3da6a0023192","year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:31.585683Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:f581f159ee14a5a2f1db1cd5066296aa5433d61c9bd303962c4fea7d22adf0c7","observation_id":"9213de61-e392-432a-957a-01f18cc978a4","resolution":{"observed_at":"2026-08-07T10:58:33.175737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14577","last_updated":"2024-10-30T22:58:40Z","snapshot_observed_at":"2026-07-06T18:18:39.093732Z","submitted_at":"2024-05-23T13:51:55Z","title":"Representation Noising: A Defence Mechanism Against Harmful Finetuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14577","snapshot_observed_at":"2026-08-07T10:58:31.656919Z","title":"Representation noising effectively prevents harmful fine-tuning on llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:31.656919Z"},"links":{"cited_paper":"/paper/2405.14577","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:5b6eb9af665259515e92168631a994ee17e6265d2e6e79774660229852d47f9c","observation_id":"e024dd50-b677-4397-9582-d93faf791fef","resolution":{"observed_at":"2026-08-07T10:58:31.656919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16382","last_updated":"2024-10-03T16:39:32Z","snapshot_observed_at":"2026-07-06T17:35:23.161066Z","submitted_at":"2024-02-26T08:08:03Z","title":"Immunization against harmful fine-tuning attacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16382","snapshot_observed_at":"2026-08-07T10:58:31.777027Z","title":"Immunization against harmful fine-tuning attacks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:31.777027Z"},"links":{"cited_paper":"/paper/2402.16382","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:7016a402fca68ec467e06f170b6cd496a86fbd9beab883c01d57fcc367f73220","observation_id":"692cf9e7-b23c-4523-93e3-a926ffd1e9cc","resolution":{"observed_at":"2026-08-07T10:58:31.777027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:31.841598Z","title":"W., Hashimoto, T","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:31.841598Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:e9d556d8ad47f698c71d3effd8d41c9afec8852b7a40b3a9b577691edcf840bb","observation_id":"a6c52886-6a07-4020-a183-0c9c52698cd9","resolution":{"observed_at":"2026-08-07T10:58:31.841598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:31.918620Z","title":"D., Ng, A","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:31.918620Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:d83196fc85d98e09ef169a9aac334e29920163a8fc8d54cc93ad738c0ac2293a","observation_id":"6970cdf6-317a-4e6d-be18-0ac31cd90c05","resolution":{"observed_at":"2026-08-07T10:58:31.918620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:32.018033Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:32.018033Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:a0917ae30deecace25a03f3fced55cc7d62c3a91fd0039838ae7088f794cd17d","observation_id":"03d73a50-2a49-4b4e-841c-df5b920aea78","resolution":{"observed_at":"2026-08-07T10:58:32.018033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T10:58:32.116438Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:32.116438Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:7790037f51dc667744feaefb85455c83565cee66d282530ca90feb2d0ade7a63","observation_id":"836a6827-2136-4cc3-99cc-2cc4c5eabf0b","resolution":{"observed_at":"2026-08-07T10:58:32.116438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-07T10:58:32.223942Z","title":"Qwen2 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:32.223942Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:926f3fc83f25f5892ae3cf28bb23b7acef1206a7c8cab76fe1fd2dcfe757218d","observation_id":"4f4a639c-f73a-4dc8-adfe-3056e664ee1f","resolution":{"observed_at":"2026-08-07T10:58:32.223942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02949","last_updated":"2023-10-04T16:39:31Z","snapshot_observed_at":"2026-08-07T11:20:01.991656Z","submitted_at":"2023-10-04T16:39:31Z","title":"Shadow Alignment: The Ease of Subverting Safely-Aligned Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02949","snapshot_observed_at":"2026-08-07T10:58:32.316238Z","title":"Y., Zhao, X., and Lin, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:32.316238Z"},"links":{"cited_paper":"/paper/2310.02949","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:6b3d8cca0717c96ac6f2958d8bbfb4fe891395f0932977d8b3c070c5baf948dc","observation_id":"2e6a2e86-1dfb-49eb-bca1-21e2781a527e","resolution":{"observed_at":"2026-08-07T10:58:32.316238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09055","last_updated":"2024-05-15T03:04:05Z","snapshot_observed_at":"2026-08-08T01:16:46.951022Z","submitted_at":"2024-05-15T03:04:05Z","title":"A safety realignment framework via subspace-oriented model fusion for large language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09055","snapshot_observed_at":"2026-08-07T10:58:32.433283Z","title":"A safety realignment framework via subspace-oriented model fusion for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:32.433283Z"},"links":{"cited_paper":"/paper/2405.09055","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:a4ccda4c0592e67a93672074e8293d1ad7a826128e85c143b07bcc4a9fef2ad1","observation_id":"34a5e47a-548e-4a19-b784-3991868611b4","resolution":{"observed_at":"2026-08-07T10:58:32.433283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05553","last_updated":"2024-04-05T23:30:56Z","snapshot_observed_at":"2026-08-07T23:30:34.877117Z","submitted_at":"2023-11-09T17:54:59Z","title":"Removing RLHF Protections in GPT-4 via Fine-Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05553","snapshot_observed_at":"2026-08-07T10:58:32.538591Z","title":"Removing rlhf protections in gpt-4 via fine-tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:32.538591Z"},"links":{"cited_paper":"/paper/2311.05553","citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:ef1a9c68df54ebd62df7da91e32678b91d7dee03f6f44c86c53da8b9e0dd8ce6","observation_id":"382b390f-a3a8-4031-8574-31eb66cb9f27","resolution":{"observed_at":"2026-08-07T10:58:32.538591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:58:32.629027Z","title":"Character-level convolutional networks for text classification","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T10:58:32.629027Z"},"links":{"citing_paper":"/paper/2506.03850"},"observation_digest":"sha256:7fd9a1808040f4c536be11ab24ae201fe07bc3652bd02f460c2f5ba747283965","observation_id":"c09f958c-6138-4837-b436-8b3cca594162","resolution":{"observed_at":"2026-08-07T10:58:32.629027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.03850","last_updated":"2025-08-12T10:16:47Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T10:51:48.293184Z","submitted_at":"2025-06-04T11:33:36Z","title":"Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":14},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 2 inbound Pith citation observations for arXiv:2506.03850."}