{"as_of":"2026-08-22T12:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:15ace4d0af62fdb235960a331d13d281d82d18a0902acaa7fc58b48faa24a16f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:34:31.210142Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":3,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.10264","last_updated":"2024-08-21T15:12:37Z","snapshot_observed_at":"2026-08-21T15:13:16.684261Z","submitted_at":"2024-07-14T16:12:57Z","title":"What Makes and Breaks Safety Fine-tuning? A Mechanistic Study","version":3},"cited_work":{"arxiv_id":"2407.10264","doi":"10.48550/arxiv.2407.10264","metadata_source":"pith","pith_arxiv_id":"2407.10264","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Oksuz, K., Joy, T., Torr, P","venue":"cs.LG","work_id":"1ffe48ac-067a-4dd4-9b52-3cda69baf0d7","year":2024},"citing_paper":{"arxiv_id":"2409.18169","last_updated":"2026-04-23T18:48:49Z","snapshot_observed_at":"2026-08-14T15:55:00.676298Z","submitted_at":"2024-09-26T17:55:22Z","title":"Harmful Fine-tuning Attacks and Defenses for Large Language Models: A Survey","version":6},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-23T20:58:16.237327Z"},"links":{"cited_paper":"/paper/2407.10264","citing_paper":"/paper/2409.18169"},"observation_digest":"sha256:58c85778eee231f0b48f8865305c977b45de7df1a65e67af588dba14e5e02dd1","observation_id":"1189faa7-1708-40d2-8270-4626c3f42098","resolution":{"observed_at":"2026-05-23T20:58:26.141571Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10264","last_updated":"2024-08-21T15:12:37Z","snapshot_observed_at":"2026-08-21T15:13:16.684261Z","submitted_at":"2024-07-14T16:12:57Z","title":"What Makes and Breaks Safety Fine-tuning? A Mechanistic Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10264","snapshot_observed_at":"2026-08-12T10:19:26.617429Z","title":"What makes and breaks safety fine-tuning? a mechanistic study,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19335","last_updated":"2024-12-19T14:30:23Z","snapshot_observed_at":"2026-08-21T05:47:46.671941Z","submitted_at":"2024-11-28T19:05:01Z","title":"PEFT-as-an-Attack! Jailbreaking Language Models during Federated Parameter-Efficient Fine-Tuning","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-12T10:19:26.617429Z"},"links":{"cited_paper":"/paper/2407.10264","citing_paper":"/paper/2411.19335"},"observation_digest":"sha256:a63f848af4e7acc9fdaa1f077e4008afad6faefa11279ea99c9f547ecf520a1d","observation_id":"2668cb19-a0eb-4783-b1ad-4cc1f96dd804","resolution":{"observed_at":"2026-08-12T10:19:26.617429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10264","last_updated":"2024-08-21T15:12:37Z","snapshot_observed_at":"2026-08-21T15:13:16.684261Z","submitted_at":"2024-07-14T16:12:57Z","title":"What Makes and Breaks Safety Fine-tuning? A Mechanistic Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10264","snapshot_observed_at":"2026-08-11T18:11:05.986317Z","title":"What makes and breaks safety fine-tuning? a mechanistic study,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.08201","last_updated":"2024-12-11T08:44:15Z","snapshot_observed_at":"2026-08-15T09:51:52.666502Z","submitted_at":"2024-12-11T08:44:15Z","title":"Model-Editing-Based Jailbreak against Safety-aligned Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T18:11:05.986317Z"},"links":{"cited_paper":"/paper/2407.10264","citing_paper":"/paper/2412.08201"},"observation_digest":"sha256:90973ba73ac5da6f3568e4bfdf8f142b75b22bd98463930fc79752ce26f44185","observation_id":"2ded35e1-2345-404e-8218-711173e0cdef","resolution":{"observed_at":"2026-08-11T18:11:05.986317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10264","last_updated":"2024-08-21T15:12:37Z","snapshot_observed_at":"2026-08-21T15:13:16.684261Z","submitted_at":"2024-07-14T16:12:57Z","title":"What Makes and Breaks Safety Fine-tuning? A Mechanistic Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10264","snapshot_observed_at":"2026-08-11T16:59:11.575679Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09565","last_updated":"2025-02-08T23:58:36Z","snapshot_observed_at":"2026-08-16T16:22:39.492260Z","submitted_at":"2024-12-12T18:49:53Z","title":"Obfuscated Activations Bypass LLM Latent-Space Defenses","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:11.575679Z"},"links":{"cited_paper":"/paper/2407.10264","citing_paper":"/paper/2412.09565"},"observation_digest":"sha256:365eba546ce8e6ff7871c179d1ef4b7da4e8d369dce4231995dd474c662dc1c7","observation_id":"c093c635-2b6c-4879-8aa7-3b2d805c3683","resolution":{"observed_at":"2026-08-11T16:59:11.575679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10264","last_updated":"2024-08-21T15:12:37Z","snapshot_observed_at":"2026-08-21T15:13:16.684261Z","submitted_at":"2024-07-14T16:12:57Z","title":"What Makes and Breaks Safety Fine-tuning? A Mechanistic Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10264","snapshot_observed_at":"2026-08-07T23:08:02.274152Z","title":"S., Oksuz, K., Joy, T., Torr, P","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09674","last_updated":"2025-05-27T08:40:42Z","snapshot_observed_at":"2026-08-17T02:07:51.696583Z","submitted_at":"2025-02-13T06:39:22Z","title":"The Hidden Dimensions of LLM Alignment: A Multi-Dimensional Analysis of Orthogonal Safety Directions","version":4},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T23:08:02.274152Z"},"links":{"cited_paper":"/paper/2407.10264","citing_paper":"/paper/2502.09674"},"observation_digest":"sha256:16c4d66b3d82b0cf73dfe023904dd1f8674f3cc84270f40e0d4374662b2536f0","observation_id":"6b9a9920-c739-4a89-8c69-f234c6012681","resolution":{"observed_at":"2026-08-07T23:08:02.274152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10264","last_updated":"2024-08-21T15:12:37Z","snapshot_observed_at":"2026-08-21T15:13:16.684261Z","submitted_at":"2024-07-14T16:12:57Z","title":"What Makes and Breaks Safety Fine-tuning? A Mechanistic Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10264","snapshot_observed_at":"2026-08-15T21:34:31.210142Z","title":"Joel Jang, Dongkeun Yoon, Sohee Yang, Sungmin Cha, Moontae Lee, Lajanugen Logeswaran, and Minjoon Seo","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.09500","last_updated":"2025-05-14T15:50:45Z","snapshot_observed_at":"2026-08-19T13:59:48.745433Z","submitted_at":"2025-05-14T15:50:45Z","title":"Layered Unlearning for Adversarial Relearning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T21:34:31.210142Z"},"links":{"cited_paper":"/paper/2407.10264","citing_paper":"/paper/2505.09500"},"observation_digest":"sha256:13fce8c25468543d54356a66c53af48561926e7e1948ce76bd9633b98b74027b","observation_id":"e7d42a64-65ba-4811-a66c-b4fb3ae22bbf","resolution":{"observed_at":"2026-08-15T21:34:31.210142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10264","last_updated":"2024-08-21T15:12:37Z","snapshot_observed_at":"2026-08-21T15:13:16.684261Z","submitted_at":"2024-07-14T16:12:57Z","title":"What Makes and Breaks Safety Fine-tuning? A Mechanistic Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10264","snapshot_observed_at":"2026-08-07T13:05:29.382934Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22756","last_updated":"2025-05-28T18:18:49Z","snapshot_observed_at":"2026-08-21T12:01:44.013708Z","submitted_at":"2025-05-28T18:18:49Z","title":"Decomposing Elements of Problem Solving: What \"Math\" Does RL Teach?","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T13:05:29.382934Z"},"links":{"cited_paper":"/paper/2407.10264","citing_paper":"/paper/2505.22756"},"observation_digest":"sha256:c466d683ebf91e1bb3d58e7bc63d33affd7a7c26b5ed7cd969de02c904654430","observation_id":"e7173816-d650-4d15-9788-34446761e211","resolution":{"observed_at":"2026-08-07T13:05:29.382934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10264","last_updated":"2024-08-21T15:12:37Z","snapshot_observed_at":"2026-08-21T15:13:16.684261Z","submitted_at":"2024-07-14T16:12:57Z","title":"What Makes and Breaks Safety Fine-tuning? A Mechanistic Study","version":3},"cited_work":{"arxiv_id":"2407.10264","doi":"10.48550/arxiv.2407.10264","metadata_source":"pith","pith_arxiv_id":"2407.10264","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Oksuz, K., Joy, T., Torr, P","venue":"cs.LG","work_id":"1ffe48ac-067a-4dd4-9b52-3cda69baf0d7","year":2024},"citing_paper":{"arxiv_id":"2605.12412","last_updated":"2026-05-12T17:09:41Z","snapshot_observed_at":"2026-08-17T11:08:42.694003Z","submitted_at":"2026-05-12T17:09:41Z","title":"Stories in Space: In-Context Learning Trajectories in Conceptual Belief Space","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-05-13T05:17:34.283917Z"},"links":{"cited_paper":"/paper/2407.10264","citing_paper":"/paper/2605.12412"},"observation_digest":"sha256:ef02e299f96c26840e38a98725cb1fc90e26e6212a53f6269b10ec84587771a9","observation_id":"52b80434-8e73-415c-8e10-c27f4df731a7","resolution":{"observed_at":"2026-05-13T05:22:18.842470Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10264","last_updated":"2024-08-21T15:12:37Z","snapshot_observed_at":"2026-08-21T15:13:16.684261Z","submitted_at":"2024-07-14T16:12:57Z","title":"What Makes and Breaks Safety Fine-tuning? A Mechanistic Study","version":3},"cited_work":{"arxiv_id":"2407.10264","doi":"10.48550/arxiv.2407.10264","metadata_source":"pith","pith_arxiv_id":"2407.10264","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Oksuz, K., Joy, T., Torr, P","venue":"cs.LG","work_id":"1ffe48ac-067a-4dd4-9b52-3cda69baf0d7","year":2024},"citing_paper":{"arxiv_id":"2607.07918","last_updated":"2026-08-14T18:25:59Z","snapshot_observed_at":"2026-08-20T23:09:41.224583Z","submitted_at":"2026-07-08T21:03:27Z","title":"Efficient Safety Alignment of Language Models via Latent Personality Traits","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-10T15:26:23.290009Z"},"links":{"cited_paper":"/paper/2407.10264","citing_paper":"/paper/2607.07918"},"observation_digest":"sha256:346e4b05fef923466ff8230b08ab9fb04873ff4ab3cc4bee4155df51de938e39","observation_id":"0310fc50-cfa6-42f9-8f08-c536caf3c83e","resolution":{"observed_at":"2026-07-10T15:27:20.138378Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10264","last_updated":"2024-08-21T15:12:37Z","snapshot_observed_at":"2026-08-21T15:13:16.684261Z","submitted_at":"2024-07-14T16:12:57Z","title":"What Makes and Breaks Safety Fine-tuning? A Mechanistic Study","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10264","snapshot_observed_at":"2026-08-01T11:29:55.413383Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19894","last_updated":"2026-07-22T08:29:06Z","snapshot_observed_at":"2026-08-20T15:42:41.210801Z","submitted_at":"2026-07-22T08:29:06Z","title":"Defense Against LLM Backdoors using Critical Neuron Isolation Pruning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T11:29:55.413383Z"},"links":{"cited_paper":"/paper/2407.10264","citing_paper":"/paper/2607.19894"},"observation_digest":"sha256:5796b6583577d93e498f49c90391a14d4de41a6c1e2c11f21c840262a45f20a0","observation_id":"5c4aa29a-72e3-4562-89ae-0cbbc73cc1d3","resolution":{"observed_at":"2026-08-01T11:29:55.413383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2407.10264/citation-record","integrity":"/paper/2407.10264/integrity","json":"/paper/2407.10264/citation-record.json","paper":"/paper/2407.10264"},"outbound":[],"paper":{"arxiv_id":"2407.10264","last_updated":"2024-08-21T15:12:37Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-21T15:13:16.684261Z","submitted_at":"2024-07-14T16:12:57Z","title":"What Makes and Breaks Safety Fine-tuning? A Mechanistic Study"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 10 inbound Pith citation observations for arXiv:2407.10264."}