{"as_of":"2026-08-08T07:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:80c55bf4d806ff39589a3d2c84134464da6359dec172ed3ccae01aa3f1a38ca1","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:56:31.634491Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:39:08.021275Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-20T14:13:21.270655Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17279","snapshot_observed_at":"2026-08-05T10:39:08.021275Z","title":"Step-by-Step Reasoning Attack: Revealing ’Erased’ Knowledge in Large Language Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03871","last_updated":"2025-09-04T04:12:31Z","snapshot_observed_at":"2026-08-08T03:54:26.940042Z","submitted_at":"2025-09-04T04:12:31Z","title":"A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models","version":1},"reference_index":215,"source":"pdf_text","source_observed_at":"2026-08-05T10:39:08.021275Z"},"links":{"cited_paper":"/paper/2506.17279","citing_paper":"/paper/2509.03871"},"observation_digest":"sha256:9b815a6c6f756481133c4fb560a41d644e955ac02979d4585bad67828dbe373a","observation_id":"a956a9d4-9a7b-4fd9-9529-87d41fb15614","resolution":{"observed_at":"2026-08-05T10:39:08.021275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"cited_work":{"arxiv_id":"2506.17279","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17279","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"M., and Kankanhalli, M","venue":null,"work_id":"fbb95678-241c-46da-b999-b4e9951deed4","year":null},"citing_paper":{"arxiv_id":"2510.00761","last_updated":"2026-04-18T07:30:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-01T10:50:14Z","title":"Downgrade to Upgrade: Optimizer Simplification Enhances Robustness in LLM Unlearning","version":5},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-18T10:44:53.516653Z"},"links":{"cited_paper":"/paper/2506.17279","citing_paper":"/paper/2510.00761"},"observation_digest":"sha256:a4e88a7df8758934c82df2137b6f898b4d54be94783c52776ed00eaf5112e546","observation_id":"db9a6592-5d7f-4966-bf8f-5cbc40517d7c","resolution":{"observed_at":"2026-05-18T10:46:17.063339Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"cited_work":{"arxiv_id":"2506.17279","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17279","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"M., and Kankanhalli, M","venue":null,"work_id":"fbb95678-241c-46da-b999-b4e9951deed4","year":null},"citing_paper":{"arxiv_id":"2605.18891","last_updated":"2026-05-17T05:22:27Z","snapshot_observed_at":"2026-07-06T23:29:42.583875Z","submitted_at":"2026-05-17T05:22:27Z","title":"Auditing Reasoning-Trace Memorization Claims after Unlearning with Head-Conditioned Canaries","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T14:10:50.885027Z"},"links":{"cited_paper":"/paper/2506.17279","citing_paper":"/paper/2605.18891"},"observation_digest":"sha256:f21f2d1b7d4c88e917377834e11ef31059a1b8b1872fae41c2bd8f26bba5e5bc","observation_id":"720ea40d-07bb-423f-8a62-a48eff257b4d","resolution":{"observed_at":"2026-05-20T14:13:21.272205Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.17279/citation-record","integrity":"/paper/2506.17279/integrity","json":"/paper/2506.17279/citation-record.json","paper":"/paper/2506.17279"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.08827","last_updated":"2025-02-07T16:27:48Z","snapshot_observed_at":"2026-08-02T18:12:46.990672Z","submitted_at":"2024-10-11T14:06:58Z","title":"Do Unlearning Methods Remove Information from Language Model Weights?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08827","snapshot_observed_at":"2026-08-07T00:56:31.527816Z","title":"Do unlearning methods remove information from language model weights? arXiv preprint arXiv:2410.08827,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.527816Z"},"links":{"cited_paper":"/paper/2410.08827","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:6a9df57debd41e7719f59f27e4ad53f98a03637ac872937b41365f9247e450da","observation_id":"bdc8e59c-a7b5-4908-9109-9b292287dc29","resolution":{"observed_at":"2026-08-07T00:56:31.527816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12949","last_updated":"2024-12-05T02:55:35Z","snapshot_observed_at":"2026-08-08T00:43:01.914749Z","submitted_at":"2024-10-16T18:35:02Z","title":"Mechanistic Unlearning: Robust Knowledge Unlearning and Editing via Mechanistic Localization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.12949","snapshot_observed_at":"2026-08-07T00:56:31.537395Z","title":"Who’s harry potter? approximate unlearning for llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.537395Z"},"links":{"cited_paper":"/paper/2410.12949","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:e9da16caff96334c0aa31b78ba7f548fe23154ad701f01fe7ae7462a5f04945b","observation_id":"02947c08-5ca2-44d0-86cb-7613044fa35a","resolution":{"observed_at":"2026-08-07T00:56:31.537395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11614","last_updated":"2025-09-01T18:50:34Z","snapshot_observed_at":"2026-07-06T18:32:15.404516Z","submitted_at":"2024-06-17T15:00:35Z","title":"Intrinsic Test of Unlearning Using Parametric Knowledge Traces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11614","snapshot_observed_at":"2026-08-07T00:56:31.542059Z","title":"Intrinsic evaluation of unlearning using parametric knowledge traces","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.542059Z"},"links":{"cited_paper":"/paper/2406.11614","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:6b19bf3d7f7a4dd5d6d0d7ec4a0f8fa9036eac79085d3d608d7bed83534173da","observation_id":"f77c2003-eba1-430b-a78a-010de4ae4e1f","resolution":{"observed_at":"2026-08-07T00:56:31.542059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13356","last_updated":"2025-03-17T07:46:49Z","snapshot_observed_at":"2026-08-01T17:13:21.519528Z","submitted_at":"2024-06-19T09:03:21Z","title":"Unlearning or Obfuscating? Jogging the Memory of Unlearned LLMs via Benign Relearning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13356","snapshot_observed_at":"2026-08-07T00:56:31.546933Z","title":"Jogging the memory of unlearned llms through targeted relearning attacks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.546933Z"},"links":{"cited_paper":"/paper/2406.13356","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:5e88a2501c08bc044789b8e1db989367bcaddeec05c25b80da177dc588549990","observation_id":"8b8d6f30-4f26-4db6-aaab-f247156245e1","resolution":{"observed_at":"2026-08-07T00:56:31.546933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06223","last_updated":"2025-02-06T02:25:18Z","snapshot_observed_at":"2026-07-06T18:59:43.564435Z","submitted_at":"2024-08-12T15:24:50Z","title":"On Effects of Steering Latent Representation for Large Language Model Unlearning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06223","snapshot_observed_at":"2026-08-07T00:56:31.551842Z","title":"On effects of steering latent representation for large language model unlearning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.551842Z"},"links":{"cited_paper":"/paper/2408.06223","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:a383d310edd3daeb038c1ed9a73c18b2afa9a41c066729275bc3e7064121ce53","observation_id":"56a68388-89da-41c6-ba31-0d16da8edfdb","resolution":{"observed_at":"2026-08-07T00:56:31.551842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.01504","last_updated":"2022-12-19T11:52:40Z","snapshot_observed_at":"2026-08-06T13:31:03.854761Z","submitted_at":"2022-10-04T10:18:11Z","title":"Knowledge Unlearning for Mitigating Privacy Risks in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.01504","snapshot_observed_at":"2026-08-07T00:56:31.556982Z","title":"Knowledge unlearning for mitigating privacy risks in language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.556982Z"},"links":{"cited_paper":"/paper/2210.01504","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:417f1be1342242c00a67ec0003209328dc3c7912f506b4fff42097015e435d1c","observation_id":"361f8a32-4eee-409d-9ea1-fe5c2f0c8023","resolution":{"observed_at":"2026-08-07T00:56:31.556982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17509","last_updated":"2025-04-12T21:23:46Z","snapshot_observed_at":"2026-07-06T19:38:13.816410Z","submitted_at":"2024-10-23T02:22:07Z","title":"WAGLE: Strategic Weight Attribution for Effective and Modular Unlearning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17509","snapshot_observed_at":"2026-08-07T00:56:31.561334Z","title":"Under review","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.561334Z"},"links":{"cited_paper":"/paper/2410.17509","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:97ce7ee451e6a5dd40a21b3dd8c54b40139ce6f40d7bef05fd2db454cd903cb8","observation_id":"d9edc7df-58a0-4387-9c96-75a07e6a84bd","resolution":{"observed_at":"2026-08-07T00:56:31.561334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18025","last_updated":"2025-05-31T19:22:41Z","snapshot_observed_at":"2026-07-06T19:22:54.212921Z","submitted_at":"2024-09-26T16:32:19Z","title":"An Adversarial Perspective on Machine Unlearning for AI Safety","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18025","snapshot_observed_at":"2026-08-07T00:56:31.574139Z","title":"An adversarial perspective on machine unlearning for ai safety","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.574139Z"},"links":{"cited_paper":"/paper/2409.18025","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:f400d27fd6881c5a78ef31ddad0fb5ebb14a49b81f5c0c00ea2c3ec499623f52","observation_id":"97392904-e4f6-4862-91f5-2e0fae35a55f","resolution":{"observed_at":"2026-08-07T00:56:31.574139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16835","last_updated":"2024-02-26T18:57:37Z","snapshot_observed_at":"2026-08-08T00:43:51.702314Z","submitted_at":"2024-02-26T18:57:37Z","title":"Eight Methods to Evaluate Robust Unlearning in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16835","snapshot_observed_at":"2026-08-07T00:56:31.579425Z","title":"Eight methods to evaluate robust unlearning in llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.579425Z"},"links":{"cited_paper":"/paper/2402.16835","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:355fdd1cda9a53fd52c6fd596c15f8ae02e6b3b352cb0a147a7e4eaf6ccc3e47","observation_id":"978c6968-bb87-44a6-88ef-92275a37f82d","resolution":{"observed_at":"2026-08-07T00:56:31.579425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17410","last_updated":"2023-09-29T17:12:43Z","snapshot_observed_at":"2026-07-06T16:25:38.571377Z","submitted_at":"2023-09-29T17:12:43Z","title":"Can Sensitive Information Be Deleted From LLMs? Objectives for Defending Against Extraction Attacks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17410","snapshot_observed_at":"2026-08-07T00:56:31.588211Z","title":"Can sensitive information be deleted from llms? objectives for defending against extraction attacks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.588211Z"},"links":{"cited_paper":"/paper/2309.17410","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:0ab944fed9e99876974c41d98bcfd2d6603da951e814dc8ba3adbed3a3efcfc4","observation_id":"fe641c6d-bf13-4359-9fbe-835593427b04","resolution":{"observed_at":"2026-08-07T00:56:31.588211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07579","last_updated":"2024-06-06T06:31:08Z","snapshot_observed_at":"2026-07-06T16:31:16.784700Z","submitted_at":"2023-10-11T15:19:31Z","title":"In-Context Unlearning: Language Models as Few Shot Unlearners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07579","snapshot_observed_at":"2026-08-07T00:56:31.592736Z","title":"In-context unlearning: Language models as few shot unlearners","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.592736Z"},"links":{"cited_paper":"/paper/2310.07579","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:ca8aa4ec6440097e6cc3eb7eeca74a9dd91dbc9af6ae0210f874769abe3be40d","observation_id":"8da2733b-f91e-450c-97a0-ffd03518c0a9","resolution":{"observed_at":"2026-08-07T00:56:31.592736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15549","last_updated":"2025-07-29T09:37:22Z","snapshot_observed_at":"2026-08-06T22:31:48.025702Z","submitted_at":"2024-07-22T11:19:14Z","title":"Latent Adversarial Training Improves Robustness to Persistent Harmful Behaviors in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15549","snapshot_observed_at":"2026-08-07T00:56:31.597065Z","title":"Latent adversarial training improves robustness to persistent harmful behaviors in llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.597065Z"},"links":{"cited_paper":"/paper/2407.15549","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:be24d7e51ffe9fdefae969361b49c57414ab027dcd04339a73227746ca3792c4","observation_id":"fa1ed3a2-4b3b-4bf8-8531-354b349b83b2","resolution":{"observed_at":"2026-08-07T00:56:31.597065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17050","last_updated":"2024-10-22T14:30:03Z","snapshot_observed_at":"2026-07-06T19:37:52.003100Z","submitted_at":"2024-10-22T14:30:03Z","title":"UnStar: Unlearning with Self-Taught Anti-Sample Reasoning for LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17050","snapshot_observed_at":"2026-08-07T00:56:31.601190Z","title":"Unstar: Unlearning with self-taught anti-sample reasoning for llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.601190Z"},"links":{"cited_paper":"/paper/2410.17050","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:c74bf0d87d81c8b1446443fdf692ce38d9547e15e0427bbfe1cbf913813323c3","observation_id":"a31b78f2-c335-4ec7-ac2d-52202a74f28b","resolution":{"observed_at":"2026-08-07T00:56:31.601190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00761","last_updated":"2025-02-10T18:26:14Z","snapshot_observed_at":"2026-08-06T05:53:06.918202Z","submitted_at":"2024-08-01T17:59:12Z","title":"Tamper-Resistant Safeguards for Open-Weight LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00761","snapshot_observed_at":"2026-08-07T00:56:31.605239Z","title":"Under review","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.605239Z"},"links":{"cited_paper":"/paper/2408.00761","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:8174606ac1ba86831bc96de134abf25f17f07ba657f6ba70ad30fca8056e679c","observation_id":"a075f13e-8f9b-48b1-990d-36327b68a518","resolution":{"observed_at":"2026-08-07T00:56:31.605239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03329","last_updated":"2024-06-11T15:47:39Z","snapshot_observed_at":"2026-08-06T08:07:03.925239Z","submitted_at":"2024-03-05T21:19:06Z","title":"Guardrail Baselines for Unlearning in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03329","snapshot_observed_at":"2026-08-07T00:56:31.609281Z","title":"Guardrail baselines for unlearning in llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.609281Z"},"links":{"cited_paper":"/paper/2403.03329","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:365e6ec421d7cf5ee1fb436f90b8b1b308548562be3e2abef87ef98bddcdeddf","observation_id":"a8f9395b-f403-41bb-9ab1-90b50e17e52b","resolution":{"observed_at":"2026-08-07T00:56:31.609281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01983","last_updated":"2024-06-04T05:51:43Z","snapshot_observed_at":"2026-08-02T23:42:41.924782Z","submitted_at":"2024-06-04T05:51:43Z","title":"RKLD: Reverse KL-Divergence-based Knowledge Distillation for Unlearning Personal Information in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01983","snapshot_observed_at":"2026-08-07T00:56:31.613263Z","title":"Rkld: Reverse kl-divergence- based knowledge distillation for unlearning personal information in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.613263Z"},"links":{"cited_paper":"/paper/2406.01983","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:e226232f73f74bb625b5a478afffc493fb74234757ca8e3485e3d4db06ff8a3d","observation_id":"7297988f-0490-4414-81ec-4e5c231f4afc","resolution":{"observed_at":"2026-08-07T00:56:31.613263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15159","last_updated":"2024-05-30T15:44:51Z","snapshot_observed_at":"2026-08-06T12:40:47.303011Z","submitted_at":"2024-02-23T07:43:26Z","title":"Machine Unlearning of Pre-trained Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15159","snapshot_observed_at":"2026-08-07T00:56:31.621944Z","title":"Machine unlearning of pre-trained large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.621944Z"},"links":{"cited_paper":"/paper/2402.15159","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:dcc0fc1d0f23cdf9dcceb0ef1580ff8582b858f7a2d18fbe294a10323cd69059","observation_id":"c7869cbf-9904-4d29-8fe1-05e08742e9da","resolution":{"observed_at":"2026-08-07T00:56:31.621944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08109","last_updated":"2025-08-10T02:49:05Z","snapshot_observed_at":"2026-08-05T10:27:24.738852Z","submitted_at":"2024-10-10T16:56:05Z","title":"A Closer Look at Machine Unlearning for Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08109","snapshot_observed_at":"2026-08-07T00:56:31.626205Z","title":"A closer look at machine unlearning for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.626205Z"},"links":{"cited_paper":"/paper/2410.08109","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:35969c7eac76ac38c089a8e34ecd31c8fee8944a9358c6f96688df0317008332","observation_id":"9653f7ae-a93f-44f8-8e55-67e2c55d42d7","resolution":{"observed_at":"2026-08-07T00:56:31.626205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05868","last_updated":"2024-10-10T22:00:41Z","snapshot_observed_at":"2026-07-06T17:57:27.510162Z","submitted_at":"2024-04-08T21:05:42Z","title":"Negative Preference Optimization: From Catastrophic Collapse to Effective Unlearning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05868","snapshot_observed_at":"2026-08-07T00:56:31.630394Z","title":"Negative preference optimization: From catastrophic collapse to effective unlearning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.630394Z"},"links":{"cited_paper":"/paper/2404.05868","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:10c591a570f39a218b8596507a6f5c115c0bfdf1f00553c8179d683e220caab5","observation_id":"0c27cbc1-2030-4101-be4d-824e2aef4e9f","resolution":{"observed_at":"2026-08-07T00:56:31.630394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:56:32.039428Z","title":"Harry Potter and the Philosopher 's Stone","venue":null,"work_id":"57ab1252-0267-4397-9dd4-8da08cea372d","year":1991},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.634491Z"},"links":{"citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:f692bd90f129ae5982c3897412c9338f573a07d780c2b26581a5daef2faab703","observation_id":"fe3ca931-590b-402e-badc-7c0433c9f1dc","resolution":{"observed_at":"2026-08-07T00:56:32.043817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.20138","last_updated":"2023-12-05T16:14:24Z","snapshot_observed_at":"2026-07-06T16:40:55.334347Z","submitted_at":"2023-10-31T03:09:36Z","title":"DEPN: Detecting and Editing Privacy Neurons in Pretrained Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.20138","snapshot_observed_at":"2026-08-07T00:56:31.617645Z","title":"Depn: Detecting and editing privacy neurons in pretrained language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.617645Z"},"links":{"cited_paper":"/paper/2310.20138","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:4f755c9b6276940005a2a1df913adf72d011663c9513f57bb33ac9725504c8c2","observation_id":"b0eeba5d-c419-48ce-8f02-52dd2272fcce","resolution":{"observed_at":"2026-08-07T00:56:31.617645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01814","last_updated":"2024-01-03T16:15:57Z","snapshot_observed_at":"2026-07-06T17:11:17.528395Z","submitted_at":"2024-01-03T16:15:57Z","title":"Large Language Models Relearn Removed Concepts","version":1},"cited_work":{"arxiv_id":"2401.01814","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.01814","snapshot_observed_at":"2026-08-07T00:56:31.887028Z","title":"Large Language Models Relearn Removed Concepts","venue":"cs.AI","work_id":"1016dac7-a7b5-4d2a-8042-f39cc3b487fa","year":2024},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.569889Z"},"links":{"cited_paper":"/paper/2401.01814","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:b0400f148f1ca2e2cfade467707b2e68df55c879ab8a85fd7f6386fb0982b449","observation_id":"adab6b89-3101-4e7b-af52-fb0761ecab07","resolution":{"observed_at":"2026-08-07T00:56:31.893913Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03218","last_updated":"2024-05-15T19:16:09Z","snapshot_observed_at":"2026-08-05T08:49:32.502826Z","submitted_at":"2024-03-05T18:59:35Z","title":"The WMDP Benchmark: Measuring and Reducing Malicious Use With Unlearning","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03218","snapshot_observed_at":"2026-08-07T00:56:31.565579Z","title":"The wmdp benchmark: Measuring and reducing malicious use with unlearning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.565579Z"},"links":{"cited_paper":"/paper/2403.03218","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:49390934844441b90ed2cedfd84ea0da360f2fb28f375a382504dfe36c2201fe","observation_id":"1264694a-a6e3-4e3c-8563-3c883efaee09","resolution":{"observed_at":"2026-08-07T00:56:31.565579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10052","last_updated":"2024-10-16T11:50:27Z","snapshot_observed_at":"2026-08-04T14:09:15.272915Z","submitted_at":"2024-02-15T16:21:14Z","title":"UNDIAL: Self-Distillation with Adjusted Logits for Robust Unlearning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10052","snapshot_observed_at":"2026-08-07T00:56:31.532882Z","title":"Undial: Self-distillation with adjusted logits for robust unlearning in large language models.arXiv preprint arXiv:2402.10052,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.532882Z"},"links":{"cited_paper":"/paper/2402.10052","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:113bc3f6bb11572c3c11f9c7037da6ab25a564d804bd7c2af166fd7e751a88a2","observation_id":"5517323e-66d1-4394-acfb-2d87c6448f53","resolution":{"observed_at":"2026-08-07T00:56:31.532882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06121","last_updated":"2024-01-11T18:57:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-11T18:57:12Z","title":"TOFU: A Task of Fictitious Unlearning for LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06121","snapshot_observed_at":"2026-08-07T00:56:31.583991Z","title":"Tofu: A task of fictitious unlearning for llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T00:56:31.583991Z"},"links":{"cited_paper":"/paper/2401.06121","citing_paper":"/paper/2506.17279"},"observation_digest":"sha256:234c474d7dc9852ce609b1d725d1ae2f8f24363a86dc10f0320f89d4c608760d","observation_id":"fbab28a2-d095-43d5-86cb-bb37dfc44c79","resolution":{"observed_at":"2026-08-07T00:56:31.583991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.17279","last_updated":"2025-06-14T04:22:17Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-08T00:43:15.134760Z","submitted_at":"2025-06-14T04:22:17Z","title":"Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":1,"verified_fuzzy":1},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 3 inbound Pith citation observations for arXiv:2506.17279."}