{"as_of":"2026-08-07T22:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2e659f0788279d9468108876d9bd4b48a8854223bdc21ee421862d290ffb54bf","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:05:56.921126Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:59:51.621664Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T19:59:54.681611Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"cited_work":{"arxiv_id":"2506.00688","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.00688","snapshot_observed_at":"2026-08-06T19:59:54.681611Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","venue":"cs.LG","work_id":"097b0db3-43ea-4dfa-99fd-61b46cbed2da","year":2025},"citing_paper":{"arxiv_id":"2507.04219","last_updated":"2026-06-17T16:48:46Z","snapshot_observed_at":"2026-08-06T19:50:32.081193Z","submitted_at":"2025-07-06T03:08:49Z","title":"Model Collapse Is Not a Bug but a Feature in Machine Unlearning for LLMs","version":5},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:59:51.621664Z"},"links":{"cited_paper":"/paper/2506.00688","citing_paper":"/paper/2507.04219"},"observation_digest":"sha256:9f80ab38396b09db5c7b1767a87b0f830c66eac7904f48dc230cd3b274b0b0dd","observation_id":"cacc932b-c9e3-42f4-b8a4-a2b303386651","resolution":{"observed_at":"2026-08-06T19:59:54.745064Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.00688/citation-record","integrity":"/paper/2506.00688/integrity","json":"/paper/2506.00688/citation-record.json","paper":"/paper/2506.00688"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:51.572953Z","title":"Are aligned neural networks adversarially aligned?Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:51.572953Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:01a67105e87fca31ab3c1c4bca47619e1540dd9f59fec704321d08a2297110be","observation_id":"ff707d62-44fc-480d-800a-0dc80713fde2","resolution":{"observed_at":"2026-08-07T12:05:51.572953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:06:00.275606Z","title":"Rethinking machine unlearning for large language models.Nature Machine Intelligence, pages 1–14, 2025","venue":null,"work_id":"fb13a14c-bf19-419b-83c8-4b7ad122f8bd","year":2025},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:51.655030Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:a7ef2db518f29dbeaf97da4a8afe1d8c607ad52b672371892fedcb8b413fce44","observation_id":"f98b6eca-868f-4d71-aee7-50f5265849f6","resolution":{"observed_at":"2026-08-07T12:06:00.384033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03218","last_updated":"2024-05-15T19:16:09Z","snapshot_observed_at":"2026-08-05T08:49:32.502826Z","submitted_at":"2024-03-05T18:59:35Z","title":"The WMDP Benchmark: Measuring and Reducing Malicious Use With Unlearning","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03218","snapshot_observed_at":"2026-08-07T12:05:51.766247Z","title":"The wmdp benchmark: Measuring and reducing malicious use with unlearning.arXiv preprint arXiv:2403.03218, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:51.766247Z"},"links":{"cited_paper":"/paper/2403.03218","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:d5e81eca9624913148f3d6c9f43b235a4dbbb51e9e3c4ca715981fd3918868fd","observation_id":"704d0e38-1681-42cb-90bf-082a31d18d0d","resolution":{"observed_at":"2026-08-07T12:05:51.766247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05868","last_updated":"2024-10-10T22:00:41Z","snapshot_observed_at":"2026-07-06T17:57:27.510162Z","submitted_at":"2024-04-08T21:05:42Z","title":"Negative Preference Optimization: From Catastrophic Collapse to Effective Unlearning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05868","snapshot_observed_at":"2026-08-07T12:05:51.844289Z","title":"Negative preference optimization: From catastrophic collapse to effective unlearning.arXiv preprint arXiv:2404.05868, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:51.844289Z"},"links":{"cited_paper":"/paper/2404.05868","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:8f3bb9bcfc208f66e5716b5f603a186565860cb867ca871c5ea0c4ead1d18801","observation_id":"b40dc7ac-ded5-4a71-9527-9005cb32af62","resolution":{"observed_at":"2026-08-07T12:05:51.844289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:06:00.098239Z","title":"Model manipulation attacks enable more rigorous evaluations of llm capabilities","venue":null,"work_id":"5966e0a8-aa13-45a6-9464-1c01c7cf898c","year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:51.954245Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:55211ba4526a4fd2ddb82595d2cbd3c511d943985bbd58330949aa2af8484ca4","observation_id":"ed586202-c046-4069-a8b9-3cad2ae29c10","resolution":{"observed_at":"2026-08-07T12:06:00.165529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18025","last_updated":"2025-05-31T19:22:41Z","snapshot_observed_at":"2026-07-06T19:22:54.212921Z","submitted_at":"2024-09-26T16:32:19Z","title":"An Adversarial Perspective on Machine Unlearning for AI Safety","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18025","snapshot_observed_at":"2026-08-07T12:05:52.023421Z","title":"An adversarial perspective on machine unlearning for ai safety.arXiv preprint arXiv:2409.18025, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:52.023421Z"},"links":{"cited_paper":"/paper/2409.18025","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:87c3d237d36d9704d641938cc5ec9588a6da57a56489a9d0535c12c4dc66aca6","observation_id":"519bc41e-0dcb-4c33-8e15-b3338189d42c","resolution":{"observed_at":"2026-08-07T12:05:52.023421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15146","last_updated":"2024-11-11T19:47:16Z","snapshot_observed_at":"2026-07-06T18:04:26.177088Z","submitted_at":"2024-04-23T15:49:37Z","title":"Rethinking LLM Memorization through the Lens of Adversarial Compression","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15146","snapshot_observed_at":"2026-08-07T12:05:52.120036Z","title":"Rethinking llm memorization through the lens of adversarial compression.arXiv preprint arXiv:2404.15146, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:52.120036Z"},"links":{"cited_paper":"/paper/2404.15146","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:0aae461b40aafd0f72d74476505cd78ecb64e00ff747567c0e00ea072b4a1991","observation_id":"6e88bdd6-2a6c-4927-89cf-0ce6d10d836f","resolution":{"observed_at":"2026-08-07T12:05:52.120036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:52.249120Z","title":"Machine unlearning: Solutions and challenges","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:52.249120Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:c53e8b39ff0ad498785331c84ea6d55d76da1dcb46d9f8c3f4e69aa762833ce0","observation_id":"8a71b73c-bb07-48a4-9b9d-98a0cfc6a2b0","resolution":{"observed_at":"2026-08-07T12:05:52.249120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:59.958666Z","title":"On the necessity of auditable algorithmic definitions for machine unlearning","venue":null,"work_id":"e6b9d3f7-b2b9-4116-b89b-72455e7852cd","year":2022},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:52.339173Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:c9fdf77ca96188d8f73d216947e524ad6b2aeef1c5253238f227f1c7835e0e93","observation_id":"8df5076b-e95c-4178-b086-4714ef621573","resolution":{"observed_at":"2026-08-07T12:05:59.995260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:52.462069Z","title":"Arcane: An efficient architecture for exact machine unlearning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:52.462069Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:664503f65526d3b792feab6f9e2d9cb30ef2bf076d35d69d936407dc52cbf7ef","observation_id":"d63ed356-3913-4242-962b-683dce0f9f0f","resolution":{"observed_at":"2026-08-07T12:05:52.462069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.03030","last_updated":"2023-11-08T03:57:25Z","snapshot_observed_at":"2026-08-06T07:29:50.928142Z","submitted_at":"2019-11-08T03:57:41Z","title":"Certified Data Removal from Machine Learning Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.03030","snapshot_observed_at":"2026-08-07T12:05:52.568143Z","title":"Certified data removal from machine learning models.arXiv preprint arXiv:1911.03030, 2019","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:52.568143Z"},"links":{"cited_paper":"/paper/1911.03030","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:f6ba3d4bbce6d2168f0947370571fd53135ad2c9b3eb6197b7a0c4d97700cbac","observation_id":"f80afe54-171c-43b7-80ce-8e8ba7e26c2a","resolution":{"observed_at":"2026-08-07T12:05:52.568143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:52.736911Z","title":"Amnesiac machine learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:52.736911Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:cd1d72f9c070c6f8b5d365a4768cbe9c2d49e4587b21d5d55c2bc46efdaf998b","observation_id":"e9204cbc-2532-4d49-9e4e-e266e13ef43b","resolution":{"observed_at":"2026-08-07T12:05:52.736911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:59.817468Z","title":"Training language models to follow instructions with human feedback.Advances in neural information processing systems, 35:27730–27744, 2022","venue":null,"work_id":"1f6faf77-37cf-4ce0-803e-8fe9acdb41ab","year":2022},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:52.863014Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:d842385391a919d555a6794d0b3b3ad512c3d854fbe92d4cfcb334e26299b565","observation_id":"0147fd8c-4e39-4fd1-a844-f63bfb74ece0","resolution":{"observed_at":"2026-08-07T12:05:59.863998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02879","last_updated":"2025-04-08T17:18:21Z","snapshot_observed_at":"2026-08-03T18:08:46.616396Z","submitted_at":"2024-10-03T18:07:25Z","title":"Position: LLM Unlearning Benchmarks are Weak Measures of Progress","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02879","snapshot_observed_at":"2026-08-07T12:05:52.922677Z","title":"Position: Llm unlearning benchmarks are weak measures of progress.arXiv preprint arXiv:2410.02879, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:52.922677Z"},"links":{"cited_paper":"/paper/2410.02879","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:b353a5f17cacef0a95f3e970925fb34d6a74fca7dc2a6fb3c7e26d58be789737","observation_id":"53739170-9478-45d9-ab81-0fe1a5c102e9","resolution":{"observed_at":"2026-08-07T12:05:52.922677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03523","last_updated":"2025-03-01T11:51:16Z","snapshot_observed_at":"2026-08-04T15:06:52.443654Z","submitted_at":"2024-10-04T15:44:23Z","title":"A Probabilistic Perspective on Unlearning and Alignment for Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03523","snapshot_observed_at":"2026-08-07T12:05:53.002524Z","title":"A probabilistic perspective on unlearning and alignment for large language models.arXiv preprint arXiv:2410.03523, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:53.002524Z"},"links":{"cited_paper":"/paper/2410.03523","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:8eb73e56216f3860b29b4fc4a41c257ef40bc2f66642a32a2adb29133e9653dc","observation_id":"d9c58f53-d6d7-4332-8e4c-5de37f7d0bdd","resolution":{"observed_at":"2026-08-07T12:05:53.002524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:53.151845Z","title":"Regulation (eu) 2016/679 of the european parliament and of the council","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:53.151845Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:d2281121f97481e89dd4c7532311dcf07e3949e031b1d0ac58c5f98287bf81ed","observation_id":"ecd16d61-77a1-42e0-876a-809b36c4e673","resolution":{"observed_at":"2026-08-07T12:05:53.151845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:59.669395Z","title":"UK General Data Protection Regulation (UK GDPR), 2021","venue":null,"work_id":"0199b688-a79e-4efe-bac2-19c9608babb6","year":2021},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:53.264350Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:54c82b6cf5cdd15a2debcc26c1a13de0f9cdb92bd5e65effd08c94f8e2290984","observation_id":"bbad220d-79b2-4982-b824-b40a48065d49","resolution":{"observed_at":"2026-08-07T12:05:59.718947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:59.516096Z","title":"Ccpa regulations: Final regulation text.Office of the Attorney General, California Department of Justice, 2021","venue":null,"work_id":"4b0d1fd0-a2d7-4b8d-8feb-25bb9249cc6b","year":2021},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:53.350332Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:95b5ed8f5d60b631b2a398ee3a58e5c0dc047fff792b89919eacccb37d03a298","observation_id":"d188f6ad-6f9e-4d2f-8da3-3478197b30bd","resolution":{"observed_at":"2026-08-07T12:05:59.574448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:59.360124Z","title":"Bill C-27: Digital Charter Implementation Act, 2022 – Consumer Privacy Protection Act (CPPA), 2022","venue":null,"work_id":"e248100c-f1a9-41a0-a3d2-2046408655f3","year":2022},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:53.436906Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:1e3163cfe3aae3cfdb2e83b8fcc43ce4e29e77a9bc2358bd990fbb1eede41869","observation_id":"5f14058e-993b-4af9-94a4-fe348c6c5c51","resolution":{"observed_at":"2026-08-07T12:05:59.430991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:53.529994Z","title":"Machine unlearning via algorithmic stability","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:53.529994Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:da841bf72cd87622d93b74da7ed6cf0756ca1ffb3c23a4169c8ab802582b4b42","observation_id":"ba6e05a5-65e4-4879-b2cc-3a16b5747e45","resolution":{"observed_at":"2026-08-07T12:05:53.529994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:59.135844Z","title":"Machine unlearning","venue":null,"work_id":"b324be31-0f12-48a8-bc66-524bf32ba6eb","year":2021},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:53.653852Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:00b7c86ce77caad22c639f46cc17fdd251aa4302f75fa3bc2346a187028b7bcd","observation_id":"c40f6bfd-3fec-45fa-8739-a12d418da566","resolution":{"observed_at":"2026-08-07T12:05:59.233072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:58.942783Z","title":"Forgetting outside the box: Scrubbing deep networks of information accessible from input-output observations","venue":null,"work_id":"1745226b-5a0b-4b09-86d8-7b135468cc7f","year":2020},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:53.763170Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:eba33606479ad402773ba832a71323695d8c4ae70cffc1ac26c0a8d3517c6b3b","observation_id":"6e098255-a136-44a3-b54c-9085396652b5","resolution":{"observed_at":"2026-08-07T12:05:59.005799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:58.784959Z","title":"Making ai forget you: Data deletion in machine learning.Advances in neural information processing systems, 32, 2019","venue":null,"work_id":"929c2bf1-bebc-4bae-ba56-268c0bb8da41","year":2019},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:53.889403Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:81928b2d0220ee64b785cbc16a29ee30d6c2b2ed4fcd2dd84cafbaf13c3354b6","observation_id":"896cf14d-407c-441a-b87b-541bf7c292d0","resolution":{"observed_at":"2026-08-07T12:05:58.852576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:53.990449Z","title":"The algorithmic foundations of differential privacy.Founda- tions and Trends® in Theoretical Computer Science, 9(3–4):211–407, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:53.990449Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:4d63ab71ff82cdad405053410071bee2b053b17b53caf153ab958d3db96f3b2e","observation_id":"127de00a-e182-44b7-a0f8-9b8e544c3df7","resolution":{"observed_at":"2026-08-07T12:05:53.990449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:58.588708Z","title":"Approximate data deletion from machine learning models","venue":null,"work_id":"ac2a91ee-303d-453f-b094-a3ae1a1eee31","year":2008},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:54.039587Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:4dbca669822e17301af88851352336bcf6e184a00cfe29457adc781fb3acb4c2","observation_id":"ed4f35cb-41be-4c86-b659-a0ccc94ac5b4","resolution":{"observed_at":"2026-08-07T12:05:58.630231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:54.109894Z","title":"Remember what you want to forget: Algorithms for machine unlearning.Advances in Neural Information Processing Systems, 34:18075–18086, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:54.109894Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:9e3de3e02c411935af8a12b2516ed0916d30d4f56af51c651cea4338c263b551","observation_id":"b9b3f8db-d4a4-444f-bf52-1fc94e50c7b8","resolution":{"observed_at":"2026-08-07T12:05:54.109894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02238","last_updated":"2023-10-04T05:20:19Z","snapshot_observed_at":"2026-08-06T15:19:35.944642Z","submitted_at":"2023-10-03T17:48:14Z","title":"Who's Harry Potter? Approximate Unlearning in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02238","snapshot_observed_at":"2026-08-07T12:05:54.154286Z","title":"Who’s harry potter? approximate unlearning in llms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:54.154286Z"},"links":{"cited_paper":"/paper/2310.02238","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:bddd29ddd874074e01a8d6ab36dabe169807eb031ef0b2bdae420d34a160c8be","observation_id":"359706bb-e0d8-4104-90dd-4ab92dd09261","resolution":{"observed_at":"2026-08-07T12:05:54.154286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06121","last_updated":"2024-01-11T18:57:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-11T18:57:12Z","title":"TOFU: A Task of Fictitious Unlearning for LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06121","snapshot_observed_at":"2026-08-07T12:05:54.220256Z","title":"Tofu: A task of fictitious unlearning for llms.arXiv preprint arXiv:2401.06121, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:54.220256Z"},"links":{"cited_paper":"/paper/2401.06121","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:21165a613ef1ef11269218052af64f08108f3fa11f43d7e687f6faea42b4c632","observation_id":"1b68dbd7-1972-40db-8609-c9c35585ad50","resolution":{"observed_at":"2026-08-07T12:05:54.220256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.03554","last_updated":"2025-03-07T16:05:19Z","snapshot_observed_at":"2026-07-06T19:45:53.289704Z","submitted_at":"2024-11-05T23:26:10Z","title":"Benchmarking Vision Language Model Unlearning via Fictitious Facial Identity Dataset","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.03554","snapshot_observed_at":"2026-08-07T12:05:54.289150Z","title":"Benchmarking vision language model unlearning via fictitious facial identity dataset, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:54.289150Z"},"links":{"cited_paper":"/paper/2411.03554","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:448ffbd132c1db8cf4cbb4deaa45da33552483e8c808f1ca47d714430ed3d239","observation_id":"83307a50-4f39-4cfc-be06-983fd0dceb4c","resolution":{"observed_at":"2026-08-07T12:05:54.289150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06460","last_updated":"2024-07-14T20:14:02Z","snapshot_observed_at":"2026-07-06T18:43:22.614883Z","submitted_at":"2024-07-08T23:47:29Z","title":"MUSE: Machine Unlearning Six-Way Evaluation for Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06460","snapshot_observed_at":"2026-08-07T12:05:54.371943Z","title":"Muse: Machine unlearning six-way evaluation for language models.arXiv preprint arXiv:2407.06460, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:54.371943Z"},"links":{"cited_paper":"/paper/2407.06460","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:6e7c358d8ce762c4f28f1ac1aaa6a0fef77addfd9a4817d2b388bcb4712b0e44","observation_id":"f6532211-495d-4c8c-b26b-ee0b292edd2b","resolution":{"observed_at":"2026-08-07T12:05:54.371943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10890","last_updated":"2024-06-16T10:47:21Z","snapshot_observed_at":"2026-08-03T22:46:04.459058Z","submitted_at":"2024-06-16T10:47:21Z","title":"RWKU: Benchmarking Real-World Knowledge Unlearning for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10890","snapshot_observed_at":"2026-08-07T12:05:54.452560Z","title":"Rwku: Benchmarking real-world knowledge unlearning for large language models.arXiv preprint arXiv:2406.10890, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:54.452560Z"},"links":{"cited_paper":"/paper/2406.10890","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:6d08ea509323595350519337d338657b9dd34e08e5c1af5ea46a9cd89e5fc423","observation_id":"49027b76-8cff-46ae-8ccd-55664d8e891d","resolution":{"observed_at":"2026-08-07T12:05:54.452560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04952","last_updated":"2025-01-09T03:59:10Z","snapshot_observed_at":"2026-07-06T20:18:31.039569Z","submitted_at":"2025-01-09T03:59:10Z","title":"Open Problems in Machine Unlearning for AI Safety","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04952","snapshot_observed_at":"2026-08-07T12:05:54.573267Z","title":"Open problems in machine unlearning for ai safety.arXiv preprint arXiv:2501.04952, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:54.573267Z"},"links":{"cited_paper":"/paper/2501.04952","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:0c5acc015bb118b123471df449066a0cf578d49eb0921d7f5a8329493bc6a031","observation_id":"3c44d985-63a4-4ab2-98f1-ef23c5ab4aba","resolution":{"observed_at":"2026-08-07T12:05:54.573267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01318","last_updated":"2024-10-31T22:26:40Z","snapshot_observed_at":"2026-08-02T14:59:12.115203Z","submitted_at":"2024-03-28T02:44:02Z","title":"JailbreakBench: An Open Robustness Benchmark for Jailbreaking Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01318","snapshot_observed_at":"2026-08-07T12:05:54.648339Z","title":"Jailbreakbench: An open robustness benchmark for jailbreaking large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:54.648339Z"},"links":{"cited_paper":"/paper/2404.01318","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:a04e5c9a7f6936d32c9c96bdc55eaed0b137a82ed6309e8e63173f0d2db0eaea","observation_id":"8435d17c-0dd1-4e7b-a12d-ac356aaf2191","resolution":{"observed_at":"2026-08-07T12:05:54.648339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:54.737706Z","title":"Simplicity prevails: Rethinking negative preference optimization for llm unlearning.arXiv preprint arXiv:2410.07163, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:54.737706Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:284555ff4d06495cbb630766e06d46b9a8dad0fb96fe6107da0004a98451f77e","observation_id":"7d675994-9cf1-4f64-9ed4-ae586d70774a","resolution":{"observed_at":"2026-08-07T12:05:54.737706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:58.448978Z","title":"Improving alignment and robustness with circuit breakers","venue":null,"work_id":"cc2d464d-8f41-4f7d-9776-6b3882e97341","year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:54.829278Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:816be7523c28b0a2e1840d81b43377fc3069d5f42a4cb5a1f4bd517110ae4b7b","observation_id":"c4757677-a82c-4a4d-8c0f-d12f75ddbeda","resolution":{"observed_at":"2026-08-07T12:05:58.521120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:58.257701Z","title":"Fast yet effective machine unlearning.IEEE Transactions on Neural Networks and Learning Systems, 2023","venue":null,"work_id":"d9f2ac1f-af47-499c-8d44-423350369cdd","year":2023},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:54.970209Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:4adcb14b99906a2bf51b117fad55e88bf9278103433c37e71fa79766aecfb567","observation_id":"9906bf18-f0d5-411e-a1c2-b98515473022","resolution":{"observed_at":"2026-08-07T12:05:58.355396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:55.042258Z","title":"Self- destructing models: Increasing the costs of harmful dual uses of foundation models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.042258Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:7ef57f00ef46e105cb9d49781ee07ad61436695c7453a51efc3244b513846fea","observation_id":"5d754615-cb60-48b8-8f88-5c1c149654ee","resolution":{"observed_at":"2026-08-07T12:05:55.042258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00761","last_updated":"2025-02-10T18:26:14Z","snapshot_observed_at":"2026-08-06T05:53:06.918202Z","submitted_at":"2024-08-01T17:59:12Z","title":"Tamper-Resistant Safeguards for Open-Weight LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00761","snapshot_observed_at":"2026-08-07T12:05:55.125060Z","title":"Tamper-resistant safeguards for open-weight llms.arXiv preprint arXiv:2408.00761, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.125060Z"},"links":{"cited_paper":"/paper/2408.00761","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:3aecf14fff45cc3f81b30096cb5e173a61dc7be812fe0d0c0fbb4e275dbb67f8","observation_id":"cedf324f-8abb-4e10-95c4-f2a870cba0f3","resolution":{"observed_at":"2026-08-07T12:05:55.125060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08827","last_updated":"2025-02-07T16:27:48Z","snapshot_observed_at":"2026-08-02T18:12:46.990672Z","submitted_at":"2024-10-11T14:06:58Z","title":"Do Unlearning Methods Remove Information from Language Model Weights?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08827","snapshot_observed_at":"2026-08-07T12:05:55.186590Z","title":"Do unlearning methods remove information from language model weights?arXiv preprint arXiv:2410.08827, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.186590Z"},"links":{"cited_paper":"/paper/2410.08827","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:2ddad4d9dc64f5150940d0187e54d9739bf42eaaf4f6e047698a967c9a5fffe9","observation_id":"d4357c90-8381-4d3c-957e-8dd7f44a1ee9","resolution":{"observed_at":"2026-08-07T12:05:55.186590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16835","last_updated":"2024-02-26T18:57:37Z","snapshot_observed_at":"2026-08-07T12:55:49.040579Z","submitted_at":"2024-02-26T18:57:37Z","title":"Eight Methods to Evaluate Robust Unlearning in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16835","snapshot_observed_at":"2026-08-07T12:05:55.328390Z","title":"Eight methods to evaluate robust unlearning in llms.arXiv preprint arXiv:2402.16835, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.328390Z"},"links":{"cited_paper":"/paper/2402.16835","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:7985d19bc347c6cbf1380258df8e0c267a454d8f60d7c03a2ad70c120696b6da","observation_id":"2765cbc7-1e9a-44c4-8c2f-9b208adf5640","resolution":{"observed_at":"2026-08-07T12:05:55.328390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15221","last_updated":"2024-09-04T00:58:59Z","snapshot_observed_at":"2026-07-06T19:06:41.697671Z","submitted_at":"2024-08-27T17:33:30Z","title":"LLM Defenses Are Not Robust to Multi-Turn Human Jailbreaks Yet","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15221","snapshot_observed_at":"2026-08-07T12:05:55.420996Z","title":"Llm defenses are not robust to multi-turn human jailbreaks yet.arXiv preprint arXiv:2408.15221, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.420996Z"},"links":{"cited_paper":"/paper/2408.15221","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:b165923193de452fc370088a313c3f19538929f41fe0d0e074a877d0356a3945","observation_id":"0795bf9e-e8f0-4fc9-b33f-0846d3705edb","resolution":{"observed_at":"2026-08-07T12:05:55.420996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17035","last_updated":"2023-11-28T18:47:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T18:47:03Z","title":"Scalable Extraction of Training Data from (Production) Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17035","snapshot_observed_at":"2026-08-07T12:05:55.549481Z","title":"Scalable extraction of training data from (production) language models.arXiv preprint arXiv:2311.17035, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.549481Z"},"links":{"cited_paper":"/paper/2311.17035","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:2cd7b047c4d6ce61ca339a8daea818900e663524ebdd46d74dbea7c0d0ed5e4d","observation_id":"f813e603-6622-497b-b82f-a6eb0e307f39","resolution":{"observed_at":"2026-08-07T12:05:55.549481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:58.051117Z","title":"Preventing generation of verba- tim memorization in language models gives a false sense of privacy","venue":null,"work_id":"972a62e3-f469-4bb0-a001-39accd81c03b","year":2023},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.630893Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:e07d2915c33bb6f84fcd11f6101720821188990f7592189b36106291a21a10bd","observation_id":"13ce2125-4e36-4fa8-9186-6d7942e9153a","resolution":{"observed_at":"2026-08-07T12:05:58.146074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13356","last_updated":"2025-03-17T07:46:49Z","snapshot_observed_at":"2026-08-01T17:13:21.519528Z","submitted_at":"2024-06-19T09:03:21Z","title":"Unlearning or Obfuscating? Jogging the Memory of Unlearned LLMs via Benign Relearning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13356","snapshot_observed_at":"2026-08-07T12:05:55.709463Z","title":"Unlearning or Obfuscating? Jogging the Memory of Unlearned LLMs via Benign Relearning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.709463Z"},"links":{"cited_paper":"/paper/2406.13356","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:f1c740584bfaf7c48c6006a4961e06ecb17cfb404790bf00efe9d3310c084e31","observation_id":"485c88b7-155e-4942-bd14-ab77ccebbffb","resolution":{"observed_at":"2026-08-07T12:05:55.709463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-07T12:05:55.788297Z","title":"Jailbreaking black box large language models in twenty queries.arXiv preprint arXiv:2310.08419, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.788297Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:6ddc84e0182ba3f8376c290dd74bace7291c6ae0a6e603d801e28e5a912f82e0","observation_id":"fece8aae-3c51-4d92-bf7a-a10a4ac90f65","resolution":{"observed_at":"2026-08-07T12:05:55.788297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-07T12:05:55.906495Z","title":"Universal and transferable adversarial attacks on aligned language models.arXiv preprint arXiv:2307.15043, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.906495Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:1fe62cd71810e2463664358a7e3b11567c1ab15ce4f2e1b4b99b80d1b3274868","observation_id":"07ca54f4-756a-4d46-a6b3-22e0c3b4126a","resolution":{"observed_at":"2026-08-07T12:05:55.906495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13691","last_updated":"2024-11-09T20:00:07Z","snapshot_observed_at":"2026-07-06T19:35:26.421419Z","submitted_at":"2024-10-17T15:55:36Z","title":"Jailbreaking LLM-Controlled Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13691","snapshot_observed_at":"2026-08-07T12:05:55.960498Z","title":"Jailbreaking llm-controlled robots.arXiv preprint arXiv:2410.13691, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:55.960498Z"},"links":{"cited_paper":"/paper/2410.13691","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:7a0b14b81d3c9477e455842c549794d0c08d6917a5e6b896e3f2df31ff38868d","observation_id":"2c7872c0-9e3f-4ff1-b7d1-43bcb9bc69d5","resolution":{"observed_at":"2026-08-07T12:05:55.960498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17447","last_updated":"2024-10-01T17:39:09Z","snapshot_observed_at":"2026-08-05T21:10:40.349698Z","submitted_at":"2024-07-24T17:23:18Z","title":"FLRT: Fluent Student-Teacher Redteaming","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17447","snapshot_observed_at":"2026-08-07T12:05:56.083076Z","title":"Flrt: Fluent student-teacher redteaming.arXiv preprint arXiv:2407.17447, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.083076Z"},"links":{"cited_paper":"/paper/2407.17447","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:7b71bfdb331abd887cf3e26d60f29fc14c2f5175b757374d5e9fc52804ed0a5d","observation_id":"928a6c23-7649-46db-85db-6a604084190f","resolution":{"observed_at":"2026-08-07T12:05:56.083076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:56.130896Z","title":"Rush, and Thomas Wolf","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.130896Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:1104af32a09b41fa4503e7e0ea4cd7c422ffa612b4146376e33373f7b825a34f","observation_id":"7aa478b5-448e-4df2-8276-a7b5318ed947","resolution":{"observed_at":"2026-08-07T12:05:56.130896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05463","last_updated":"2023-09-11T14:01:45Z","snapshot_observed_at":"2026-08-02T22:47:03.212781Z","submitted_at":"2023-09-11T14:01:45Z","title":"Textbooks Are All You Need II: phi-1.5 technical report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05463","snapshot_observed_at":"2026-08-07T12:05:56.208500Z","title":"Textbooks are all you need ii: phi-1.5 technical report, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.208500Z"},"links":{"cited_paper":"/paper/2309.05463","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:330a1dc36d3fa4f6cfe1b2244e18824882c3747273fb22bee63fe3007b3d43b0","observation_id":"3ca46dc5-1a51-4180-bf1f-d96d1b4cfc0c","resolution":{"observed_at":"2026-08-07T12:05:56.208500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T12:05:56.277372Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.277372Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:797f24ed6a802f3c5242403c7d8f0031e9204fa7ebfa4686d8a8209436d088e7","observation_id":"86ca618a-a163-4bac-b187-b1beac9c5f8a","resolution":{"observed_at":"2026-08-07T12:05:56.277372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.10077","last_updated":"2020-02-25T03:12:57Z","snapshot_observed_at":"2026-07-06T08:46:09.705605Z","submitted_at":"2019-12-20T19:49:32Z","title":"Are Transformers universal approximators of sequence-to-sequence functions?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.10077","snapshot_observed_at":"2026-08-07T12:05:56.351628Z","title":"Are transformers universal approximators of sequence-to-sequence functions?arXiv preprint arXiv:1912.10077, 2019","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.351628Z"},"links":{"cited_paper":"/paper/1912.10077","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:e4073464cdaa7a81663a482d3f11f737161b445fa6b9193b9b3f1934395e56d3","observation_id":"a2084ee9-b7bd-45a0-8515-4d9860c7f7c7","resolution":{"observed_at":"2026-08-07T12:05:56.351628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15299","last_updated":"2025-08-06T13:42:41Z","snapshot_observed_at":"2026-08-07T16:51:41.471700Z","submitted_at":"2025-03-19T15:21:48Z","title":"Inside-Out: Hidden Factual Knowledge in LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.15299","snapshot_observed_at":"2026-08-07T12:05:56.438082Z","title":"Inside-out: Hidden factual knowledge in llms.arXiv preprint arXiv:2503.15299, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.438082Z"},"links":{"cited_paper":"/paper/2503.15299","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:a57b1a5205526ed1e08b121579c25ac9e8ffb4fa8e670f82c069315af40283f8","observation_id":"64a9edca-15b9-4bf1-bfba-02c9d176ce4b","resolution":{"observed_at":"2026-08-07T12:05:56.438082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.03061","last_updated":"2020-05-22T21:58:58Z","snapshot_observed_at":"2026-08-04T09:46:11.579002Z","submitted_at":"2020-04-07T01:06:36Z","title":"Information-Theoretic Probing for Linguistic Structure","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.03061","snapshot_observed_at":"2026-08-07T12:05:56.506312Z","title":"Information-theoretic probing for linguistic structure.arXiv preprint arXiv:2004.03061, 2020","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.506312Z"},"links":{"cited_paper":"/paper/2004.03061","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:882a0cbc17fbf00b52318fdac72c06b86714aea5e3ab9b70b1e1bab9923eda02","observation_id":"97545fc3-8b39-467e-b691-9dab13b78728","resolution":{"observed_at":"2026-08-07T12:05:56.506312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12617","last_updated":"2024-12-18T03:03:08Z","snapshot_observed_at":"2026-08-07T20:10:40.005791Z","submitted_at":"2024-05-21T09:12:20Z","title":"Quantifying Semantic Emergence in Language Models","version":2},"cited_work":{"arxiv_id":"2405.12617","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.12617","snapshot_observed_at":"2026-08-07T12:05:57.146058Z","title":"Quantifying Semantic Emergence in Language Models","venue":"cs.CL","work_id":"1a629718-1106-4f57-84c2-38904584eddc","year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.612126Z"},"links":{"cited_paper":"/paper/2405.12617","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:c15616f8701882af03f0cf98002d0d35b7383674a0b92acb5ccac5dda19e3802","observation_id":"2c3b377a-ec42-4c72-bf5e-87202cc538ee","resolution":{"observed_at":"2026-08-07T12:05:57.239317Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:05:57.919119Z","title":"Measuring and modifying factual knowledge in large language models","venue":null,"work_id":"3eee2cdf-d758-45f5-9340-4818bc1de261","year":2023},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.685470Z"},"links":{"citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:944bb6539424023dc8c68bdcabdde655d7934343d0c9405d89f7eb328a70079f","observation_id":"4610c999-c621-45b3-bfd6-2721d8619e66","resolution":{"observed_at":"2026-08-07T12:05:57.956958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11324","last_updated":"2024-07-01T22:28:01Z","snapshot_observed_at":"2026-08-04T15:07:29.209129Z","submitted_at":"2023-10-17T15:03:30Z","title":"Quantifying Language Models' Sensitivity to Spurious Features in Prompt Design or: How I learned to start worrying about prompt formatting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11324","snapshot_observed_at":"2026-08-07T12:05:56.757190Z","title":"Quantifying language models’ sensitivity to spurious features in prompt design or: How i learned to start worrying about prompt formatting.arXiv preprint arXiv:2310.11324, 2023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.757190Z"},"links":{"cited_paper":"/paper/2310.11324","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:1bad5fcaac0a3118b9d333e290af316d030f7f339bfa72caa6143cd1538c45f5","observation_id":"b7b88fb4-20ef-490b-a7e5-975aef909afc","resolution":{"observed_at":"2026-08-07T12:05:56.757190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.03882","last_updated":"2024-02-22T01:40:35Z","snapshot_observed_at":"2026-08-06T19:10:47.693909Z","submitted_at":"2023-09-07T17:44:56Z","title":"Large Language Models Are Not Robust Multiple Choice Selectors","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.03882","snapshot_observed_at":"2026-08-07T12:05:56.806697Z","title":"Large language models are not robust multiple choice selectors.arXiv preprint arXiv:2309.03882, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.806697Z"},"links":{"cited_paper":"/paper/2309.03882","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:ac338206f027d74e30103054ae4a22c1567e35553cd9c549270095b9c857c936","observation_id":"9c9e14a4-7774-4374-9178-d1651ba39f18","resolution":{"observed_at":"2026-08-07T12:05:56.806697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-07-06T19:51:09.829522Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-07T12:05:56.921126Z","title":"Does prompt formatting have any impact on llm performance?arXiv preprint arXiv:2411.10541, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T12:05:56.921126Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2506.00688"},"observation_digest":"sha256:2732bdabdf3c07a03d8487a260d8a727d31bb87a995a603711fc0eaee6e797f0","observation_id":"c2dbf4f5-0b16-4863-992b-3b745ee773c4","resolution":{"observed_at":"2026-08-07T12:05:56.921126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.00688","last_updated":"2025-05-31T19:43:00Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T11:57:53.307873Z","submitted_at":"2025-05-31T19:43:00Z","title":"Existing Large Language Model Unlearning Evaluations Are Inconclusive"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":1,"verified_fuzzy":15},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 1 inbound Pith citation observation for arXiv:2506.00688."}