{"as_of":"2026-08-16T08:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:85eb60a55c197a5091389500b7ee1d27b3a462dfd6a41b7b273e54345d70414d","coverage":[{"denominator":61,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":61,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:55:14.070225Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T07:46:08.836451Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-15T04:45:00.946977Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"cited_work":{"arxiv_id":"2507.21182","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.21182","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2507.21182 , year=","venue":null,"work_id":"e21cdf13-ca0e-43ab-8d10-14af1d777b6b","year":2025},"citing_paper":{"arxiv_id":"2604.09688","last_updated":"2026-04-06T09:30:49Z","snapshot_observed_at":"2026-08-14T02:11:26.907660Z","submitted_at":"2026-04-06T09:30:49Z","title":"Immunizing 3D Gaussian Generative Models Against Unauthorized Fine-Tuning via Attribute-Space Traps","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-10T19:30:06.396482Z"},"links":{"cited_paper":"/paper/2507.21182","citing_paper":"/paper/2604.09688"},"observation_digest":"sha256:21a0d35ea1fea85c987e7098181d262e85bbe0479a6be2e2d0dc2d30aa1286cb","observation_id":"9621278c-7a10-4eb5-a00b-f6a485e84322","resolution":{"observed_at":"2026-05-10T22:55:48.899871Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"cited_work":{"arxiv_id":"2507.21182","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.21182","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2507.21182 , year=","venue":null,"work_id":"e21cdf13-ca0e-43ab-8d10-14af1d777b6b","year":2025},"citing_paper":{"arxiv_id":"2605.14194","last_updated":"2026-06-05T04:14:41Z","snapshot_observed_at":"2026-08-15T01:38:38.911249Z","submitted_at":"2026-05-13T23:19:55Z","title":"GradShield: Alignment Preserving Finetuning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-15T04:44:06.614390Z"},"links":{"cited_paper":"/paper/2507.21182","citing_paper":"/paper/2605.14194"},"observation_digest":"sha256:f8d60215926d1a0ed97f46fbdf21bb97c894aab133e4a7424cdc39be35d7a4bf","observation_id":"dcc4fd69-422b-40f8-8ead-9904507bdeae","resolution":{"observed_at":"2026-05-15T04:45:00.951155Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.21182","snapshot_observed_at":"2026-08-01T07:46:08.836451Z","title":"arXiv preprint arXiv:2507.21182 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21356","last_updated":"2026-07-23T14:19:28Z","snapshot_observed_at":"2026-08-14T00:44:11.658093Z","submitted_at":"2026-07-23T14:19:28Z","title":"Emergent Misalignment Recruits a Pre-existing Persona Subspace","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-01T07:46:08.836451Z"},"links":{"cited_paper":"/paper/2507.21182","citing_paper":"/paper/2607.21356"},"observation_digest":"sha256:123e466aad565d1b91a204b8cfec60d15ad7cb03aeb28ce6b8c7ec08c4cc6c32","observation_id":"988ed788-82f9-4433-bb8a-ba90cde03218","resolution":{"observed_at":"2026-08-01T07:46:08.836451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.21182/citation-record","integrity":"/paper/2507.21182/integrity","json":"/paper/2507.21182/citation-record.json","paper":"/paper/2507.21182"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-15T17:55:13.725286Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.725286Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:0c7d9830a40b968d04c10670e7e730e68f1d1c229187a5080ce7f504acf5f91e","observation_id":"19693b82-36a2-4966-b18f-52033639ce59","resolution":{"observed_at":"2026-08-15T17:55:13.725286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.09816","last_updated":"2023-02-15T10:01:31Z","snapshot_observed_at":"2026-08-13T20:43:53.414882Z","submitted_at":"2020-12-17T18:34:45Z","title":"Towards Understanding Ensemble, Knowledge Distillation and Self-Distillation in Deep Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.09816","snapshot_observed_at":"2026-08-15T17:55:13.736803Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.736803Z"},"links":{"cited_paper":"/paper/2012.09816","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:ee3149d980423c3fbc6184800074d2cc51c5842f5271d5516e3510d4ac33264c","observation_id":"5a7d25de-d0b7-4356-9b7a-ba51c792bef9","resolution":{"observed_at":"2026-08-15T17:55:13.736803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:15.193270Z","title":null,"venue":null,"work_id":"1eb21102-8120-43f9-b458-6135f83f14cd","year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.743195Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:c043c5618f2dc37ade03c7cf54501a0fdeed502f2bfc30f965b5c94c70a603ff","observation_id":"0ac7078a-6ac4-46c3-9844-d444b27a95fb","resolution":{"observed_at":"2026-08-15T17:55:15.198060Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.02893","last_updated":"2020-03-27T19:07:58Z","snapshot_observed_at":"2026-08-16T03:32:37.688772Z","submitted_at":"2019-07-05T15:26:26Z","title":"Invariant Risk Minimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.02893","snapshot_observed_at":"2026-08-15T17:55:13.748348Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.748348Z"},"links":{"cited_paper":"/paper/1907.02893","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:747e85ad2054e0547934718c449503c05dfd6ed0c59496a419e37fbfd3fe7914","observation_id":"7a6821dd-634d-4643-836b-c012c6f4e095","resolution":{"observed_at":"2026-08-15T17:55:13.748348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00861","last_updated":"2021-12-09T21:40:22Z","snapshot_observed_at":"2026-08-10T12:03:10.373653Z","submitted_at":"2021-12-01T22:24:34Z","title":"A General Language Assistant as a Laboratory for Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00861","snapshot_observed_at":"2026-08-15T17:55:13.753911Z","title":"Brown, Jack Clark, Sam McCandlish, Chris Olah, and Jared Kaplan","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.753911Z"},"links":{"cited_paper":"/paper/2112.00861","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:2e4e4fd2e6fa0477962fde3fbbf5310b563515fa3d57b843dcd87faa9395d336","observation_id":"e0928c9a-0e0b-4a46-8acb-16bd7f5c0ed8","resolution":{"observed_at":"2026-08-15T17:55:13.753911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-15T17:55:13.759174Z","title":"Brown, Jack Clark, Sam McCandlish, Chris Olah, Benjamin Mann, and Jared Kaplan","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.759174Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:8ebaccd295865c34f2ebd22aad58ccca1ae1173fc2533375493d8cfaf9e08ffc","observation_id":"e079766f-74e4-41ad-9939-9923773acebd","resolution":{"observed_at":"2026-08-15T17:55:13.759174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.14303","last_updated":"2023-11-13T05:28:47Z","snapshot_observed_at":"2026-08-14T02:38:11.876404Z","submitted_at":"2023-10-22T13:55:46Z","title":"Language Model Unalignment: Parametric Red-Teaming to Expose Hidden Harms and Biases","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.14303","snapshot_observed_at":"2026-08-15T17:55:13.765034Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.765034Z"},"links":{"cited_paper":"/paper/2310.14303","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:490fbdfab5225ec6046646da5c1c2d39f5509c940d2d097a9a08b13441ac1da4","observation_id":"9548ae66-4538-41e0-9c68-f900bab0d174","resolution":{"observed_at":"2026-08-15T17:55:13.765034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:13.770029Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.770029Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:003d39d5702b875fb53924ff01e766983d18858dd23159fc081552eb135e3dc8","observation_id":"f3d19aae-fa94-479d-b7b8-225520d0a681","resolution":{"observed_at":"2026-08-15T17:55:13.770029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:15.165483Z","title":null,"venue":null,"work_id":"e05e368f-8b24-4947-a776-db3f07262944","year":2022},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.774585Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:7b36fdf705cec2f5a0dea1019a4f86c66d7712679d7cd4aa6a5e5e8d67df780f","observation_id":"0560f7f3-a974-4fb3-858d-fe4b17f882a0","resolution":{"observed_at":"2026-08-15T17:55:15.170421Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02311","snapshot_observed_at":"2026-08-15T17:55:13.779264Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.779264Z"},"links":{"cited_paper":"/paper/2204.02311","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:67493356b24fb157aecd6ac24b38a8a7ae149562ad6d36b143bae96ef96933b4","observation_id":"fea9462e-ecda-4490-b008-e3c95d2f2d9e","resolution":{"observed_at":"2026-08-15T17:55:13.779264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:13.784457Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.784457Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:190614d7ad5e6e444db1be6c2eba95d5a4d4fb8abe6e1352548bd4aa590789a6","observation_id":"df6cb45f-5197-4121-9d2f-8cecba6eaa46","resolution":{"observed_at":"2026-08-15T17:55:13.784457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00117","last_updated":"2024-05-28T10:33:03Z","snapshot_observed_at":"2026-08-13T05:35:24.562119Z","submitted_at":"2023-10-31T19:45:15Z","title":"BadLlama: cheaply removing safety fine-tuning from Llama 2-Chat 13B","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00117","snapshot_observed_at":"2026-08-15T17:55:13.789814Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.789814Z"},"links":{"cited_paper":"/paper/2311.00117","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:f2336ab8c6d2196bfda47384a6a222ad924b69eaa519ccc31e6978730f8d0a93","observation_id":"024a154c-afbc-4364-a7cd-85d5d7c6eb1b","resolution":{"observed_at":"2026-08-15T17:55:13.789814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12793","last_updated":"2024-07-30T03:58:11Z","snapshot_observed_at":"2026-08-14T09:56:00.692687Z","submitted_at":"2024-06-18T16:58:21Z","title":"ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12793","snapshot_observed_at":"2026-08-15T17:55:13.794700Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.794700Z"},"links":{"cited_paper":"/paper/2406.12793","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:67eb8825cab9add7647e09662f2552f37d515f4b5f14c050542c51d12f5b5744","observation_id":"96a3381c-ad50-460b-9fc0-ac9a05f6c113","resolution":{"observed_at":"2026-08-15T17:55:13.794700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18233","last_updated":"2023-11-01T13:52:36Z","snapshot_observed_at":"2026-08-13T05:40:40.536488Z","submitted_at":"2023-10-25T13:43:16Z","title":"Will releasing the weights of future large language models grant widespread access to pandemic agents?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.18233","snapshot_observed_at":"2026-08-15T17:55:13.799482Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.799482Z"},"links":{"cited_paper":"/paper/2310.18233","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:c14044495000988d755292373dd775c8ae5e80b43ccaade45a536e3dfe848ace","observation_id":"f34a0f7d-d202-4194-ac34-981ac8a18d5e","resolution":{"observed_at":"2026-08-15T17:55:13.799482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06972","last_updated":"2023-12-22T18:01:44Z","snapshot_observed_at":"2026-08-14T14:49:31.752145Z","submitted_at":"2023-05-11T16:55:19Z","title":"Spear Phishing With Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06972","snapshot_observed_at":"2026-08-15T17:55:13.804188Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.804188Z"},"links":{"cited_paper":"/paper/2305.06972","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:1f848f3dd8f695275fd652278ca5a4a64de12f3a30d1635585f70b156e4b7f19","observation_id":"5cacd874-ab0d-458d-9ba2-2d0a5f4f251b","resolution":{"observed_at":"2026-08-15T17:55:13.804188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:15.140085Z","title":"Manning, Dan Jurafsky, and Chelsea Finn","venue":null,"work_id":"b10d253b-d772-4a1a-996f-4b27291aad1c","year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.809512Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:4f95437a677cbeab0212379a4506e56ceaab0bcae1cec96f5919e1c4b12250d2","observation_id":"5f5cc971-ca58-4ecc-b5a0-41caa113420e","resolution":{"observed_at":"2026-08-15T17:55:15.145099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:15.122079Z","title":null,"venue":null,"work_id":"7006334a-9313-48a4-8fa6-6a92c00e22e4","year":2021},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.814221Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:8fd43f0e3f3a1417282483c693916efa319fbd4131784d7b38e2dc3058f0347a","observation_id":"3cb7f07b-8f1b-4ce7-bc1d-aab912b3cfc7","resolution":{"observed_at":"2026-08-15T17:55:15.127370Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.11176","last_updated":"2023-05-24T04:17:34Z","snapshot_observed_at":"2026-08-15T01:53:08.411718Z","submitted_at":"2023-05-18T17:59:49Z","title":"Instruct2Act: Mapping Multi-modality Instructions to Robotic Actions with Large Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.11176","snapshot_observed_at":"2026-08-15T17:55:13.818599Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.818599Z"},"links":{"cited_paper":"/paper/2305.11176","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:198c28da70f39771664416dfa5f6a30b20b363aa4239119fe5f0b39d1f2d5c80","observation_id":"8bba5e72-74ee-4bf1-aed0-22d240228810","resolution":{"observed_at":"2026-08-15T17:55:13.818599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18169","last_updated":"2026-04-23T18:48:49Z","snapshot_observed_at":"2026-08-14T15:55:00.676298Z","submitted_at":"2024-09-26T17:55:22Z","title":"Harmful Fine-tuning Attacks and Defenses for Large Language Models: A Survey","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18169","snapshot_observed_at":"2026-08-15T17:55:13.824400Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.824400Z"},"links":{"cited_paper":"/paper/2409.18169","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:53c6a9d9bbba38f0cadadb01457171d00c63a7775e6c0a823118e8f15758f811","observation_id":"3bd5f0f0-a413-460d-9fb1-a00c2f80df74","resolution":{"observed_at":"2026-08-15T17:55:13.824400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:15.103112Z","title":null,"venue":null,"work_id":"1cc2f2de-572a-44db-bb00-cb7b5300451b","year":2025},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.829865Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:93e05690d2dba1afcecd5927bc489d6d12044c55a5ac9cc8a26e91b308efb859","observation_id":"c44ad53c-8969-49d4-b7f4-e87dee755ab3","resolution":{"observed_at":"2026-08-15T17:55:15.109642Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01109","last_updated":"2024-11-24T20:09:55Z","snapshot_observed_at":"2026-08-13T19:54:16.744887Z","submitted_at":"2024-02-02T02:56:50Z","title":"Vaccine: Perturbation-aware Alignment for Large Language Models against Harmful Fine-tuning Attack","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01109","snapshot_observed_at":"2026-08-15T17:55:13.834761Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.834761Z"},"links":{"cited_paper":"/paper/2402.01109","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:9b4b5ee643e1957945a3ba181438b89e11ee38692fc0890c897823572d47c87b","observation_id":"49fba8c5-efad-467c-9814-a62acba02429","resolution":{"observed_at":"2026-08-15T17:55:13.834761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:13.839797Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.839797Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:f3b64135c819a10a6f327b608248e3efc1f7828afa71549c6777aa8ddab6cf34","observation_id":"3a703f7f-b66b-4b07-9f4b-eb0a409e6e4e","resolution":{"observed_at":"2026-08-15T17:55:13.839797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:15.074546Z","title":null,"venue":null,"work_id":"a23615da-0b89-4f36-8f9f-b8e47ba630a8","year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.844486Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:aaac99efc2ab3136e72c73c52d398eac32f56c09405253e0ac1e462cafa25c7e","observation_id":"16691936-c84d-4cfd-b88f-ad1bdd547309","resolution":{"observed_at":"2026-08-15T17:55:15.080480Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.20624","last_updated":"2024-05-22T08:39:46Z","snapshot_observed_at":"2026-08-15T09:29:43.760307Z","submitted_at":"2023-10-31T16:55:06Z","title":"LoRA Fine-tuning Efficiently Undoes Safety Training in Llama 2-Chat 70B","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.20624","snapshot_observed_at":"2026-08-15T17:55:13.849490Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.849490Z"},"links":{"cited_paper":"/paper/2310.20624","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:730c2f4b8f818547851ab45482cc9fdfab0e7117e94f9fb954b825a20e8aec77","observation_id":"2d34fdb0-117e-4693-9828-ae8a0c129d4b","resolution":{"observed_at":"2026-08-15T17:55:13.849490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:15.057208Z","title":null,"venue":null,"work_id":"63029d84-7d00-4007-91d8-f72707e39bfb","year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.855311Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:a32b197052b48e749c02cf74eb5d1d66e39ef86cad753368c706698e18dc7abb","observation_id":"c433e800-24dd-42bd-97de-7f0a43cdf9db","resolution":{"observed_at":"2026-08-15T17:55:15.062431Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17230","last_updated":"2024-07-14T08:02:49Z","snapshot_observed_at":"2026-08-13T10:02:16.488998Z","submitted_at":"2023-09-29T13:29:22Z","title":"Spurious Feature Diversification Improves Out-of-distribution Generalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17230","snapshot_observed_at":"2026-08-15T17:55:13.860473Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.860473Z"},"links":{"cited_paper":"/paper/2309.17230","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:02c1a44ac38544fd20741ae46f58c1017093ec8aa0c6eff002d5d1acc70132b2","observation_id":"ef7c91a6-7714-45f7-84c4-ec3ad290b026","resolution":{"observed_at":"2026-08-15T17:55:13.860473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09760","last_updated":"2025-01-31T14:26:27Z","snapshot_observed_at":"2026-08-12T22:24:31.552695Z","submitted_at":"2024-10-13T07:36:45Z","title":"Targeted Vaccine: Safety Alignment for Large Language Models against Harmful Fine-Tuning via Layer-wise Perturbation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09760","snapshot_observed_at":"2026-08-15T17:55:13.865845Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.865845Z"},"links":{"cited_paper":"/paper/2410.09760","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:77368c23eb2d4b9e1313ba150876013d867ee963c202561278f12cdbb83b18f3","observation_id":"d753062d-7496-4b61-aca7-e85fe104860f","resolution":{"observed_at":"2026-08-15T17:55:13.865845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19358","last_updated":"2024-05-31T02:09:51Z","snapshot_observed_at":"2026-08-15T15:00:28.821331Z","submitted_at":"2024-05-24T04:50:38Z","title":"Robustifying Safety-Aligned Large Language Models through Clean Data Curation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19358","snapshot_observed_at":"2026-08-15T17:55:13.870946Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.870946Z"},"links":{"cited_paper":"/paper/2405.19358","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:a9f3c428fccbe0e0e9d5b39adf3cb2f8d502f048ebeec76095b428db9bc6a06b","observation_id":"218c90f4-0d96-4391-a0fd-c8f4b35fb6dd","resolution":{"observed_at":"2026-08-15T17:55:13.870946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09442","last_updated":"2023-08-21T07:49:37Z","snapshot_observed_at":"2026-08-14T14:27:22.230352Z","submitted_at":"2023-08-18T10:14:35Z","title":"BioMedGPT: Open Multimodal Generative Pre-trained Transformer for BioMedicine","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09442","snapshot_observed_at":"2026-08-15T17:55:13.876183Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.876183Z"},"links":{"cited_paper":"/paper/2308.09442","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:d1878c4b81779584df08ead0a10f815e855d2f4c660eb4e185780a2c9e605b15","observation_id":"139c2e72-1d87-46fe-ba6a-a0cde68c243f","resolution":{"observed_at":"2026-08-15T17:55:13.876183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14734","last_updated":"2024-11-01T20:05:19Z","snapshot_observed_at":"2026-08-15T19:24:05.829199Z","submitted_at":"2024-05-23T16:01:46Z","title":"SimPO: Simple Preference Optimization with a Reference-Free Reward","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14734","snapshot_observed_at":"2026-08-15T17:55:13.881021Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.881021Z"},"links":{"cited_paper":"/paper/2405.14734","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:e34c641e223eaef05b121edb7c2906b574d599d916fc5519987e24f74a370d6f","observation_id":"d0b3af2a-d5aa-4a63-8a1e-37716d4fdfa1","resolution":{"observed_at":"2026-08-15T17:55:13.881021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:15.039617Z","title":null,"venue":null,"work_id":"fc630478-3347-42e8-a171-a1e1fc36f241","year":2024},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.886584Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:e63bc3d8f1b36546d61fc299eb9e3db0f3d1da6e759dfb01e452cdfcf8aaeeda","observation_id":"cf9558ce-f833-4d55-9891-fdf2ad5b072f","resolution":{"observed_at":"2026-08-15T17:55:15.045707Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:13.891970Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.891970Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:9c04ff01bd700efaef99306ca609f8ff3d165c7cad878fc077c0f2c66f2a2313","observation_id":"e04cf625-f0a3-44c6-9259-b55b0ac7672d","resolution":{"observed_at":"2026-08-15T17:55:13.891970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:15.007436Z","title":null,"venue":null,"work_id":"db9969e0-2010-4329-b291-daf861fc86a2","year":2007},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.897479Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:514c9378250c1cfbce783ce330fc68ea23890b384fe47973f2e5d17346b42bf2","observation_id":"f6596feb-7fb1-477a-b1ef-337b08a99336","resolution":{"observed_at":"2026-08-15T17:55:15.014126Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:14.987643Z","title":null,"venue":null,"work_id":"aa523ccb-db02-4d5f-a574-21687422b28c","year":2022},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.902020Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:aafa9b95896e6bff38d5945880119da8d0dbb57cfeb2cc2d510efb8132a2e73d","observation_id":"ac9dd152-c508-4102-a46c-86dd66dd27ba","resolution":{"observed_at":"2026-08-15T17:55:14.993873Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:14.971364Z","title":null,"venue":null,"work_id":"4ea23b01-4fd6-41d1-83e3-250724a105f9","year":2025},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.908358Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:ce0e27cc8840b5b6c68897a1d584aea0b6501f85feef37fa92b1f1674c386440","observation_id":"c54ba3fa-9e99-4458-8fb5-c8cae4f4c5c2","resolution":{"observed_at":"2026-08-15T17:55:14.976518Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:14.951644Z","title":null,"venue":null,"work_id":"da0ff162-f1ff-43c0-b5f1-909c467c2198","year":2022},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.913713Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:68287d50dbf2d31f294c7d51d330f56c9c72f80b73305f0912692ca526fa59c5","observation_id":"af6d1605-f5d1-47e7-898a-228304c67d56","resolution":{"observed_at":"2026-08-15T17:55:14.957139Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05946","last_updated":"2024-06-10T00:35:23Z","snapshot_observed_at":"2026-08-12T23:46:49.092229Z","submitted_at":"2024-06-10T00:35:23Z","title":"Safety Alignment Should Be Made More Than Just a Few Tokens Deep","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05946","snapshot_observed_at":"2026-08-15T17:55:13.918912Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.918912Z"},"links":{"cited_paper":"/paper/2406.05946","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:4570bde51400a63221ca0b059673d1773bc7097908eeed1949d5e91f73fc6bed","observation_id":"c28db790-7490-4122-ab14-0aea2495f2b1","resolution":{"observed_at":"2026-08-15T17:55:13.918912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03693","last_updated":"2023-10-05T17:12:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-05T17:12:17Z","title":"Fine-tuning Aligned Language Models Compromises Safety, Even When Users Do Not Intend To!","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03693","snapshot_observed_at":"2026-08-15T17:55:13.928361Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.928361Z"},"links":{"cited_paper":"/paper/2310.03693","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:82ded32b88e616f6766f30f4783e8f194533ef9cfde442dec98e0b7ccbe03df1","observation_id":"7c4a1bf2-204e-4ff9-adb8-2e6c9304e885","resolution":{"observed_at":"2026-08-15T17:55:13.928361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:14.934289Z","title":"Manning, Stefano Ermon, and Chelsea Finn","venue":null,"work_id":"a0832776-3c47-44e5-9796-ccc39476f655","year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.934314Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:fa1377a1475ef52378fc9f350210381512fa4eeaa821f8291224472d3722090e","observation_id":"72a95aad-b02b-4994-98fa-7f5dfb343766","resolution":{"observed_at":"2026-08-15T17:55:14.939942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10084","last_updated":"2019-08-27T08:50:17Z","snapshot_observed_at":"2026-08-14T05:02:11.716316Z","submitted_at":"2019-08-27T08:50:17Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.10084","snapshot_observed_at":"2026-08-15T17:55:13.939841Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.939841Z"},"links":{"cited_paper":"/paper/1908.10084","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:0baad0b3492323d492da47f7299e473f7811fe5af53facee93613b0091f79e68","observation_id":"de66096f-486e-487d-aa45-cf8eb4c76568","resolution":{"observed_at":"2026-08-15T17:55:13.939841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:14.918333Z","title":null,"venue":null,"work_id":"487aea5d-0c8a-4afc-958c-5d5dedf87b99","year":2024},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.945021Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:61f2e7d8af9c562a025eb64d57e4fba20e90b20689689b8a6b6f4c96a0b8ee56","observation_id":"c19c6b36-8c91-4812-8500-d55804f2845e","resolution":{"observed_at":"2026-08-15T17:55:14.923138Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.05761","last_updated":"2021-03-27T16:23:24Z","snapshot_observed_at":"2026-08-11T23:09:07.883190Z","submitted_at":"2020-10-12T14:54:32Z","title":"The Risks of Invariant Risk Minimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.05761","snapshot_observed_at":"2026-08-15T17:55:13.950811Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.950811Z"},"links":{"cited_paper":"/paper/2010.05761","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:a0bf08fee34ddc0179d85f3bebf5de8a24cb944d30bd3e7b5addaee03ac8446c","observation_id":"4fa50c34-ca7b-4f84-8ade-5d6d844bfa87","resolution":{"observed_at":"2026-08-15T17:55:13.950811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:14.901982Z","title":null,"venue":null,"work_id":"c1c53554-0e1a-43be-8eca-1f1413846eba","year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.956513Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:483ab9d9f714aacf3320fb59b87a0dfe22f65eb8a8987d4ea0b8d3b1dfaf016d","observation_id":"759cadca-3f04-40f2-9ad3-3128302714fe","resolution":{"observed_at":"2026-08-15T17:55:14.907552Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:14.877748Z","title":"Ziegler, Ryan Lowe, Chelsea Voss, Alec Radford, Dario Amodei, and Paul F","venue":null,"work_id":"d3f31bbe-09d3-4981-8441-e887032945fe","year":2020},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.962549Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:4195552ab2d5dab80964ad5ce89f049c0451da5dbf75382c37bce31d61b35401","observation_id":"a4dbacc2-2948-4795-a75c-1a05cf4278a3","resolution":{"observed_at":"2026-08-15T17:55:14.887588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:14.858488Z","title":null,"venue":null,"work_id":"7b547c17-b517-4de6-9f31-c6d54e697de8","year":2025},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.967973Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:d4ec65f819abf9e30f9f669378a3e095b6456d2947bfca3b701936c10fdb3a54","observation_id":"40c438cb-afbd-44c6-8952-a8430d44453d","resolution":{"observed_at":"2026-08-15T17:55:14.863872Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:13.972796Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.972796Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:914f1e4bde2cc761884bf0a6d7c8a6d3ac29dadec77738d74fcd7041de27aac8","observation_id":"08fc65b0-8348-4838-b18b-88f08afcf5f1","resolution":{"observed_at":"2026-08-15T17:55:13.972796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-15T17:55:13.983176Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.983176Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:85df49f3db14c39d48d9cad9ba7192f12a404a957297642048924921d7c44b4f","observation_id":"afc5bc9c-b228-49f0-8183-97d65de57d47","resolution":{"observed_at":"2026-08-15T17:55:13.983176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-15T17:55:13.989079Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.989079Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:0264538612c96c9d7786fbf70f933003d66089077481a1bce296b296b45f22b1","observation_id":"76a7a51a-73fc-41d8-9c42-b5831e623813","resolution":{"observed_at":"2026-08-15T17:55:13.989079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:14.824358Z","title":null,"venue":null,"work_id":"1bfd4118-4255-4672-958d-ff9fcbbb33f2","year":2022},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:13.993870Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:580f257dd037cd0a8754246967fee9f21894b4738e92e9d3c019f2a528c60962","observation_id":"9a36cc09-9f00-459e-8dc5-5a2558606ac1","resolution":{"observed_at":"2026-08-15T17:55:14.833702Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:14.806613Z","title":null,"venue":null,"work_id":"ca4e036f-7515-422d-93bf-fba75b52b60c","year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:14.000306Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:c25231efb81516b1b2f30608ca38bb34567e34ad586492f3353045f165714487","observation_id":"cd38159c-9305-4696-89fe-48a08a622172","resolution":{"observed_at":"2026-08-15T17:55:14.811946Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05162","last_updated":"2024-10-24T19:21:52Z","snapshot_observed_at":"2026-08-13T04:24:02.200648Z","submitted_at":"2024-02-07T18:34:38Z","title":"Assessing the Brittleness of Safety Alignment via Pruning and Low-Rank Modifications","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05162","snapshot_observed_at":"2026-08-15T17:55:14.008458Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:14.008458Z"},"links":{"cited_paper":"/paper/2402.05162","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:f7682787a7202419791365973c87206ce27f97b6bb916536c55700dd53576ff9","observation_id":"1f295d79-792d-48c6-b9de-c9f683ddced6","resolution":{"observed_at":"2026-08-15T17:55:14.008458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:14.780209Z","title":"Zhao, Kelvin Guu, Adams Wei Yu, Brian Lester, Nan Du, Andrew M","venue":null,"work_id":"ca86ab8e-c9b6-4729-8535-b289c4cc461a","year":2022},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:14.013517Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:c0bc599ac35ce90a826b22a9bc8b7393c1e16d30d1bf78de3c8d8ea1a1c26298","observation_id":"5358107b-11fe-4fd8-9e1c-3ef9ada4c501","resolution":{"observed_at":"2026-08-15T17:55:14.786325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16682","last_updated":"2024-04-22T22:51:32Z","snapshot_observed_at":"2026-08-14T14:26:41.039383Z","submitted_at":"2023-12-27T18:53:09Z","title":"Some things are more CRINGE than others: Iterative Preference Optimization with the Pairwise Cringe Loss","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.16682","snapshot_observed_at":"2026-08-15T17:55:14.018443Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:14.018443Z"},"links":{"cited_paper":"/paper/2312.16682","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:00543401ac56bedf98af84edb30626ea801202367ff023197b9bf08c404e7c30","observation_id":"c5aa7db9-83ae-4f37-8887-021ba9e8eade","resolution":{"observed_at":"2026-08-15T17:55:14.018443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:14.755145Z","title":null,"venue":null,"work_id":"47a8ff55-1cd1-4014-85ce-25c1c48c7116","year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:14.026348Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:4b612e0c55986d5576b68c1d875fcb182179ec28cb814c989ed18dbf4718c0ff","observation_id":"9b9ab330-1cd2-4a80-b88a-dcb1d0c34424","resolution":{"observed_at":"2026-08-15T17:55:14.766705Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02949","last_updated":"2023-10-04T16:39:31Z","snapshot_observed_at":"2026-08-13T05:57:27.605916Z","submitted_at":"2023-10-04T16:39:31Z","title":"Shadow Alignment: The Ease of Subverting Safely-Aligned Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02949","snapshot_observed_at":"2026-08-15T17:55:14.032498Z","title":"Petzold, William Yang Wang, Xun Zhao, and Dahua Lin","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:14.032498Z"},"links":{"cited_paper":"/paper/2310.02949","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:fedfad4b97509d0266e7a59e1c0088cfc052e875d3a94a1736213b4ad190cdf9","observation_id":"b7964131-1802-4170-9105-c6f4ee58b793","resolution":{"observed_at":"2026-08-15T17:55:14.032498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10020","last_updated":"2025-03-28T00:06:51Z","snapshot_observed_at":"2026-08-15T01:20:08.134494Z","submitted_at":"2024-01-18T14:43:47Z","title":"Self-Rewarding Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10020","snapshot_observed_at":"2026-08-15T17:55:14.037842Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:14.037842Z"},"links":{"cited_paper":"/paper/2401.10020","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:2f8dcf67044ff4e3a94674f276675633b877b4844dd9ebbf1d8874400c4429af","observation_id":"6d69086d-697c-4e8c-9585-f6b5bbf74fa8","resolution":{"observed_at":"2026-08-15T17:55:14.037842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05553","last_updated":"2024-04-05T23:30:56Z","snapshot_observed_at":"2026-08-13T05:28:57.633730Z","submitted_at":"2023-11-09T17:54:59Z","title":"Removing RLHF Protections in GPT-4 via Fine-Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05553","snapshot_observed_at":"2026-08-15T17:55:14.043471Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:14.043471Z"},"links":{"cited_paper":"/paper/2311.05553","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:afc91e3b912375c83233020e643070a8178d1a714fb5c1183b94423a8464be52","observation_id":"66e8f456-5755-460c-97bf-a83e487df1c3","resolution":{"observed_at":"2026-08-15T17:55:14.043471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:14.725390Z","title":null,"venue":null,"work_id":"38b36fd6-f323-4f1c-ac1f-a9680a9abf62","year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:14.048923Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:4649e7ca224fbc64092b8dfe3712b556ef936ba2210df58759d86f8ce1287647","observation_id":"b786a24d-dde6-4123-97a0-53bc3771afcf","resolution":{"observed_at":"2026-08-15T17:55:14.736732Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.02105","last_updated":"2023-11-02T09:18:21Z","snapshot_observed_at":"2026-08-15T22:00:48.017050Z","submitted_at":"2023-11-02T09:18:21Z","title":"Making Harmful Behaviors Unlearnable for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.02105","snapshot_observed_at":"2026-08-15T17:55:14.054517Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:14.054517Z"},"links":{"cited_paper":"/paper/2311.02105","citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:484751d63325fd7d40d5f84b059fa12c8e0f3509d65bc22dbc8377a8cf59d8a3","observation_id":"a0b91e01-9ded-4ea9-8f5f-030f3982a2c0","resolution":{"observed_at":"2026-08-15T17:55:14.054517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:14.060124Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:14.060124Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:d2b6251a6735f97821710acede7db3a0b19354715a5736c396453ac578be9d1b","observation_id":"cea0e38b-c00d-4aa9-bf07-bfd4db651030","resolution":{"observed_at":"2026-08-15T17:55:14.060124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:55:14.070225Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-15T17:55:14.070225Z"},"links":{"citing_paper":"/paper/2507.21182"},"observation_digest":"sha256:70f5abf935d59207c5b30cb9870c478510e3682c6ebf8535a1164a1c682ad207","observation_id":"91d9699d-f303-4c93-99f8-1c709b823b88","resolution":{"observed_at":"2026-08-15T17:55:14.070225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.21182","last_updated":"2025-07-27T02:08:21Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-16T02:27:12.681381Z","submitted_at":"2025-07-27T02:08:21Z","title":"SDD: Self-Degraded Defense against Malicious Fine-tuning"},"reference_resolution":{"displayed":61,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":57,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":61},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 3 inbound Pith citation observations for arXiv:2507.21182."}