{"as_of":"2026-08-09T15:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d8b1c42bdc3466dbc6ca7d5858c27a66261000953719648c7a197d4b7be80775","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T20:08:57.514936Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.05159/citation-record","integrity":"/paper/2502.05159/integrity","json":"/paper/2502.05159/citation-record.json","paper":"/paper/2502.05159"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.06619","last_updated":"2024-12-09T16:13:17Z","snapshot_observed_at":"2026-08-09T00:02:36.819520Z","submitted_at":"2024-12-09T16:13:17Z","title":"Copyright-Protected Language Generation via Adaptive Model Fusion","version":1},"cited_work":{"arxiv_id":"2412.06619","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.06619","snapshot_observed_at":"2026-08-08T20:08:57.949206Z","title":"Copyright-Protected Language Generation via Adaptive Model Fusion","venue":"cs.LG","work_id":"4c59d8fe-2377-4460-b3cf-79819b27584c","year":2024},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.247629Z"},"links":{"cited_paper":"/paper/2412.06619","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:6a5c41af5232c9e0a0452e320abadc1fb157131765ca4b2e7c79835de4460967","observation_id":"fc06a381-c6de-4988-94eb-a172d01e7931","resolution":{"observed_at":"2026-08-08T20:08:57.953888Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:57.253008Z","title":"Deep learning with differential privacy","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.253008Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:ae9e8e927160994115de69844a7786a8164a7b3b9fe98854b715c32be872d6e3","observation_id":"6fbe8091-c76a-4f29-993d-7f213dd0d3e1","resolution":{"observed_at":"2026-08-08T20:08:57.253008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-08T20:08:57.256985Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.256985Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:583b28ba2542790b043d91bb6b0287d6afe6083fe22c624dc8ef4fad0b4d5f2e","observation_id":"b8959d6a-46b3-49eb-b5cb-c0a748f279a5","resolution":{"observed_at":"2026-08-08T20:08:57.256985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02737","last_updated":"2025-02-04T21:43:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-04T21:43:16Z","title":"SmolLM2: When Smol Goes Big -- Data-Centric Training of a Small Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02737","snapshot_observed_at":"2026-08-08T20:08:57.261674Z","title":"Smollm2: When smol goes big--data-centric training of a small language model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.261674Z"},"links":{"cited_paper":"/paper/2502.02737","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:ee8bfc5ab0640e2f72dcacec799edc299518b7de806821baf3bf435346f3aca2","observation_id":"8f656a0f-a84b-413c-b257-814d9beb584a","resolution":{"observed_at":"2026-08-08T20:08:57.261674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:58.218542Z","title":"Physics of language models: Part 3.3, knowledge capacity scaling laws","venue":null,"work_id":"7eaddd13-e74f-456e-84ab-edeb6a28442d","year":2025},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.265845Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:ab16e7ffd6ddc502c2d2c40a7da9ff85249a89a39059b71d7ba5728aff72c6f3","observation_id":"4dd82cc8-3118-4921-b6f6-d25a72487b88","resolution":{"observed_at":"2026-08-08T20:08:58.222638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.01624","last_updated":"2021-08-03T16:51:36Z","snapshot_observed_at":"2026-07-06T11:35:14.629601Z","submitted_at":"2021-08-03T16:51:36Z","title":"Large-Scale Differentially Private BERT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.01624","snapshot_observed_at":"2026-08-08T20:08:57.270395Z","title":"Large-scale differentially private bert","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.270395Z"},"links":{"cited_paper":"/paper/2108.01624","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:4fc9d7bfbdb1b9aede3175bf425d8a4617d84c962d86feb9d4495afeaa9a1478","observation_id":"807bf33c-57d7-452b-9f79-7ea34005f6ae","resolution":{"observed_at":"2026-08-08T20:08:57.270395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09327","last_updated":"2024-07-18T17:37:59Z","snapshot_observed_at":"2026-08-06T19:51:59.338010Z","submitted_at":"2024-02-14T17:17:30Z","title":"Information Complexity of Stochastic Convex Optimization: Applications to Generalization and Memorization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09327","snapshot_observed_at":"2026-08-08T20:08:57.275663Z","title":"Information complexity of stochastic convex optimization: Applications to generalization and memorization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.275663Z"},"links":{"cited_paper":"/paper/2402.09327","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:cd8c554c1df90374e1e678aa7c9a15814b085e87e31c0a188daf6cd99fb93182","observation_id":"89d0b8c9-37f5-4fad-afc5-bfc94d30165e","resolution":{"observed_at":"2026-08-08T20:08:57.275663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.14966","last_updated":"2021-01-14T21:36:02Z","snapshot_observed_at":"2026-08-09T05:16:30.145678Z","submitted_at":"2020-07-29T17:22:26Z","title":"Mirostat: A Neural Text Decoding Algorithm that Directly Controls Perplexity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.14966","snapshot_observed_at":"2026-08-08T20:08:57.279687Z","title":"Mirostat: A neural text decoding algorithm that directly controls perplexity","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.279687Z"},"links":{"cited_paper":"/paper/2007.14966","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:bf070771c8f5ed5e6b57a243984890d1f11045d0a87751354337c903eb4f0f69","observation_id":"349d2339-b466-4c0b-aaee-38d5a8e5f8ca","resolution":{"observed_at":"2026-08-08T20:08:57.279687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01373","last_updated":"2023-05-31T17:54:07Z","snapshot_observed_at":"2026-08-07T23:49:29.478548Z","submitted_at":"2023-04-03T20:58:15Z","title":"Pythia: A Suite for Analyzing Large Language Models Across Training and Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.01373","snapshot_observed_at":"2026-08-08T20:08:57.283516Z","title":"Pythia: A suite for analyzing large language models across training and scaling, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.283516Z"},"links":{"cited_paper":"/paper/2304.01373","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:cf978fcc05eb1b9d9d75ba5b70bfdfffb6b21554d9e44df59b4c7b0d533b0e34","observation_id":"195b94fb-221a-4670-b05a-4515bac6a188","resolution":{"observed_at":"2026-08-08T20:08:57.283516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:57.287563Z","title":"Emergent and predictable memorization in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.287563Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:83d61d07b80ec226679455a1c3d6e14f356cb01ec4a3713d040b51bd6e30eac0","observation_id":"aa61a99b-9f3a-420e-961d-f6a993ed8ae5","resolution":{"observed_at":"2026-08-08T20:08:57.287563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:57.291266Z","title":"Piqa: Reasoning about physical commonsense in natural language","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.291266Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:33278e6100d54bf88d819262aa51fbfed23f661bf2bd1c651635715706e3a339","observation_id":"34aadf66-5f4e-41c8-bac9-13250cbdf6f1","resolution":{"observed_at":"2026-08-08T20:08:57.291266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:58.195619Z","title":"Wikipedia, the free encyclopedia","venue":null,"work_id":"767f576b-7e9f-4ab2-be1a-e0a6ab58ab10","year":2001},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.295017Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:baf9cf4774b0ec6cf05319d5a5bbdf6e8ec557fe9ea48c35e0c9ae548c6f8ab1","observation_id":"47d69e1c-7096-48a4-ad8c-3cb3c15ea156","resolution":{"observed_at":"2026-08-08T20:08:58.200038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:58.185329Z","title":"Targeted memorized‐data unlearning for large language models","venue":null,"work_id":"2fa7b7ca-6225-4115-bbe4-4edb626588e6","year":2024},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.298418Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:c0d9e27039d43291c7bdb634f12208bafe958a8367df11278d2b18bf863556e8","observation_id":"fa722a2d-d573-47f2-87ee-29a7f5ee5fb1","resolution":{"observed_at":"2026-08-08T20:08:58.189060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:57.301920Z","title":"Extracting training data from large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.301920Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:610e85b6a6514851ca2027cd9942aa7cd6016d4fc754a295ebdf17c61927b98d","observation_id":"eb2ef0b0-5d0f-4317-a106-b4164bd961e0","resolution":{"observed_at":"2026-08-08T20:08:57.301920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.07646","last_updated":"2023-03-06T06:28:18Z","snapshot_observed_at":"2026-08-03T19:51:05.627063Z","submitted_at":"2022-02-15T18:48:31Z","title":"Quantifying Memorization Across Neural Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.07646","snapshot_observed_at":"2026-08-08T20:08:57.305404Z","title":"Quantifying memorization across neural language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.305404Z"},"links":{"cited_paper":"/paper/2202.07646","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:bc267a68aa19bc1db8955fabd4a45a5f33c0f9269afdb7624cd3eedbb3808f60","observation_id":"8fe3a03b-f428-4690-93e2-1dce58bb4ce5","resolution":{"observed_at":"2026-08-08T20:08:57.305404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:58.167722Z","title":"Do localization methods actually localize memorized data in llms? a tale of two benchmarks","venue":null,"work_id":"0caa91aa-e60a-48ed-a163-90b184f8c4f3","year":2024},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.309496Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:56145ebc3b825092bfc8ba2c4c555dffa109baafef0cef061fe349bdfddd6566","observation_id":"09fe5233-3b88-484a-a2e0-750c08b3e6a0","resolution":{"observed_at":"2026-08-08T20:08:58.172298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:58.157221Z","title":"Neural surgery for memorisation: Locating and removing verbatim recall neurons","venue":null,"work_id":"24b2abb6-df40-41df-a17e-344aea3fa2ba","year":2024},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.313147Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:92832652fe59fc725740ead7674a035d70d6c411a5fc26d65fd3f5f68a9e7777","observation_id":"a3efbc0b-3346-43bc-9782-15ed867e906e","resolution":{"observed_at":"2026-08-08T20:08:58.161104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08066","last_updated":"2023-08-15T22:49:30Z","snapshot_observed_at":"2026-08-09T04:19:17.217083Z","submitted_at":"2023-08-15T22:49:30Z","title":"The Geometry of Constant Function Market Makers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08066","snapshot_observed_at":"2026-08-08T20:08:57.318096Z","title":"Accelerating large language model decoding with speculative sampling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.318096Z"},"links":{"cited_paper":"/paper/2308.08066","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:7f88a599cb8bb3b8909b6225753f252051f2b8df5fe6aa077dc1ed764242c4e1","observation_id":"65a35925-5fc3-42b2-a5d6-d2abfdab0984","resolution":{"observed_at":"2026-08-08T20:08:57.318096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14452","last_updated":"2025-07-17T18:57:22Z","snapshot_observed_at":"2026-08-07T16:00:51.674906Z","submitted_at":"2025-04-20T01:59:46Z","title":"ParaPO: Aligning Language Models to Reduce Verbatim Reproduction of Pre-training Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14452","snapshot_observed_at":"2026-08-08T20:08:57.322125Z","title":"Parapo: Aligning language models to reduce verbatim reproduction of pre-training data","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.322125Z"},"links":{"cited_paper":"/paper/2504.14452","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:ac5daf9e7ac1fb04c603f3c6237d528f330c49c0553fab47c8cddba8ce29f143","observation_id":"3142da95-84b7-45da-9503-ac79ab796a6d","resolution":{"observed_at":"2026-08-08T20:08:57.322125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10044","last_updated":"2019-05-24T05:48:49Z","snapshot_observed_at":"2026-07-06T07:55:12.121264Z","submitted_at":"2019-05-24T05:48:49Z","title":"BoolQ: Exploring the Surprising Difficulty of Natural Yes/No Questions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.10044","snapshot_observed_at":"2026-08-08T20:08:57.325819Z","title":"Boolq: Exploring the surprising difficulty of natural yes/no questions","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.325819Z"},"links":{"cited_paper":"/paper/1905.10044","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:b4bc3b8f2a7185020c8f6421e4431b4fdae5e057a51a1ddf9f0ff1e8bde183fe","observation_id":"2b70624b-e620-4e46-8066-e6a7ed0db8c3","resolution":{"observed_at":"2026-08-08T20:08:57.325819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-08T20:08:57.330593Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.330593Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:0d71e084a601b70a1ed20b2becb2e994458aed894ac635169ed0872d50ebb5b2","observation_id":"4eb2ecef-7cf6-4752-92a2-f12810a78d74","resolution":{"observed_at":"2026-08-08T20:08:57.330593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:58.146262Z","title":"The corpus of contemporary american english as the first reliable monitor corpus of english","venue":null,"work_id":"f1c2cfe6-7ca8-42f9-8f8e-86b5f56afa30","year":2010},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.334536Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:dd3ad27bb4af2f1c0d5ff8df1be4ef8e04d6f9755319f39fd778d5af4d4bdde5","observation_id":"cb1b3609-a6cc-40e8-bfae-d36ae43bf38b","resolution":{"observed_at":"2026-08-08T20:08:58.149771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-08T20:08:57.338218Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.338218Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:998b3775268fec6b39876205e45b0d33ecb1661fcb972f39fc9112a6a10439be","observation_id":"00fc16e0-f1da-4091-8a71-99ac84cfb233","resolution":{"observed_at":"2026-08-08T20:08:57.338218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02238","last_updated":"2023-10-04T05:20:19Z","snapshot_observed_at":"2026-08-06T15:19:35.944642Z","submitted_at":"2023-10-03T17:48:14Z","title":"Who's Harry Potter? Approximate Unlearning in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02238","snapshot_observed_at":"2026-08-08T20:08:57.341933Z","title":"Who’s harry potter? approximate unlearning in llms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.341933Z"},"links":{"cited_paper":"/paper/2310.02238","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:5a528b887f2719fef5b07410f2b1bed7006d9d04b9edd0009735bbf675c96724","observation_id":"eb44ab29-1486-44c8-b049-ea1d1b5aed00","resolution":{"observed_at":"2026-08-08T20:08:57.341933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14822","last_updated":"2024-03-24T13:01:18Z","snapshot_observed_at":"2026-07-06T15:32:18.583350Z","submitted_at":"2023-05-24T07:22:41Z","title":"Can Copyright be Reduced to Privacy?","version":2},"cited_work":{"arxiv_id":"2305.14822","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.14822","snapshot_observed_at":"2026-08-08T20:08:57.810468Z","title":"Can Copyright be Reduced to Privacy?","venue":"cs.LG","work_id":"c556b21c-45fb-4820-b8c0-e33d1583ac2c","year":2023},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.345598Z"},"links":{"cited_paper":"/paper/2305.14822","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:4f03b2214604f44545228d10785161d300e16f317b3760e13f979bd7e91d6f3d","observation_id":"acac0fc0-d61c-4747-a5ea-b52e3da919a6","resolution":{"observed_at":"2026-08-08T20:08:57.814487Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.04833","last_updated":"2018-05-13T07:07:08Z","snapshot_observed_at":"2026-07-06T06:38:48.758485Z","submitted_at":"2018-05-13T07:07:08Z","title":"Hierarchical Neural Story Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.04833","snapshot_observed_at":"2026-08-08T20:08:57.350286Z","title":"Hierarchical neural story generation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.350286Z"},"links":{"cited_paper":"/paper/1805.04833","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:4f308a15d8cabf99164146f6539df84ef65fa4b765494f0871a3ff066a4a9157","observation_id":"5d7397fc-d826-4601-b4e7-d9985e5fbe0e","resolution":{"observed_at":"2026-08-08T20:08:57.350286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06370","last_updated":"2024-12-09T10:44:47Z","snapshot_observed_at":"2026-07-06T20:03:47.277630Z","submitted_at":"2024-12-09T10:44:47Z","title":"Exploring Memorization and Copyright Violation in Frontier LLMs: A Study of the New York Times v. OpenAI 2023 Lawsuit","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06370","snapshot_observed_at":"2026-08-08T20:08:57.353850Z","title":"Exploring memorization and copyright violation in frontier llms: A study of the new york times v","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.353850Z"},"links":{"cited_paper":"/paper/2412.06370","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:0ddb9932644269c6795d62fdd0047e5357651bbbff295e8cb1a3097a83dbef8e","observation_id":"e5b20004-ccb1-4fc0-8109-bf49ba8a772f","resolution":{"observed_at":"2026-08-08T20:08:57.353850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:58.135578Z","title":"The times sues openai and microsoft over ai use of copyrighted work","venue":null,"work_id":"0987f42c-e55f-4fa5-8cde-0444e283e8a2","year":2023},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.357649Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:0008b5e44da4b456d6f3a726c3b3acf8b4c05d1759ee1353a9c05bfe47f15445","observation_id":"25398975-271e-46e0-912b-3f11b98d8bb5","resolution":{"observed_at":"2026-08-08T20:08:58.139277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:58.124852Z","title":"Leetcode problem dataset, 2021","venue":null,"work_id":"c5a33de4-f9fb-4f7b-b3ec-ffb7fcf82916","year":2021},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.361669Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:40ddbc72df88a7d4ef1ffdd8d39584491a5cbd392dfbd97954d2b23d30b2eae7","observation_id":"daadf5f6-4e4c-40d4-87f5-1f1f1d074a43","resolution":{"observed_at":"2026-08-08T20:08:58.128737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10209","last_updated":"2024-11-02T23:19:18Z","snapshot_observed_at":"2026-08-05T02:50:00.813169Z","submitted_at":"2024-06-14T17:44:22Z","title":"Be like a Goldfish, Don't Memorize! Mitigating Memorization in Generative LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10209","snapshot_observed_at":"2026-08-08T20:08:57.365034Z","title":"Be like a goldfish, don't memorize! mitigating memorization in generative llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.365034Z"},"links":{"cited_paper":"/paper/2406.10209","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:45e04cb4a176f19fffb5afcd2b7bc19cf78fcb2dd1732d8107e350b951755719","observation_id":"3d26e1d3-e9c8-4333-b763-5ee1d05470bd","resolution":{"observed_at":"2026-08-08T20:08:57.365034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18362","last_updated":"2023-10-24T14:25:53Z","snapshot_observed_at":"2026-07-06T16:39:40.673808Z","submitted_at":"2023-10-24T14:25:53Z","title":"SoK: Memorization in General-Purpose Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.18362","snapshot_observed_at":"2026-08-08T20:08:57.369870Z","title":"Sok: Memorization in general-purpose large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.369870Z"},"links":{"cited_paper":"/paper/2310.18362","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:fd91191986ab70e304cd818c91929f73344853c1d12158636ef02843ec895b36","observation_id":"0b5f86ce-1c4d-4fd1-aef5-8d253e9d7ad4","resolution":{"observed_at":"2026-08-08T20:08:57.369870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01933","last_updated":"2023-10-09T15:38:46Z","snapshot_observed_at":"2026-08-09T04:45:14.956800Z","submitted_at":"2023-04-04T16:31:37Z","title":"LLM-Adapters: An Adapter Family for Parameter-Efficient Fine-Tuning of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.01933","snapshot_observed_at":"2026-08-08T20:08:57.373671Z","title":"Llm-adapters: An adapter family for parameter-efficient fine-tuning of large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.373671Z"},"links":{"cited_paper":"/paper/2304.01933","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:4b7450f3ce9f83f0777ac53d62a5a7cd3b5e788b040b309274bcd6bab0cd84a9","observation_id":"23a1376e-4b33-4bb5-86f9-22277cf77a6f","resolution":{"observed_at":"2026-08-08T20:08:57.373671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17817","last_updated":"2024-07-25T07:10:31Z","snapshot_observed_at":"2026-07-06T18:51:41.167282Z","submitted_at":"2024-07-25T07:10:31Z","title":"Demystifying Verbatim Memorization in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17817","snapshot_observed_at":"2026-08-08T20:08:57.377140Z","title":"Demystifying verbatim memorization in large language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.377140Z"},"links":{"cited_paper":"/paper/2407.17817","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:c7844c9641d3024bc29d8e2da6552ef37f8bbc8e89e35402e80f480dfb6e08c5","observation_id":"84ff37c5-46d0-4732-a194-298cbc6d3c49","resolution":{"observed_at":"2026-08-08T20:08:57.377140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17546","last_updated":"2023-09-11T16:58:48Z","snapshot_observed_at":"2026-08-04T04:34:05.607113Z","submitted_at":"2022-10-31T17:57:55Z","title":"Preventing Verbatim Memorization in Language Models Gives a False Sense of Privacy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17546","snapshot_observed_at":"2026-08-08T20:08:57.381019Z","title":"Preventing verbatim memorization in language models gives a false sense of privacy","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.381019Z"},"links":{"cited_paper":"/paper/2210.17546","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:ef6acf56ca883d384e93d6017ffe71e77b44dd6b3b0346946910575b2413a845","observation_id":"2bc12b95-f8ac-44cc-97a5-a9bb4ea893db","resolution":{"observed_at":"2026-08-08T20:08:57.381019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.01504","last_updated":"2022-12-19T11:52:40Z","snapshot_observed_at":"2026-08-08T23:31:41.429978Z","submitted_at":"2022-10-04T10:18:11Z","title":"Knowledge Unlearning for Mitigating Privacy Risks in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.01504","snapshot_observed_at":"2026-08-08T20:08:57.384769Z","title":"Knowledge unlearning for mitigating privacy risks in language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.384769Z"},"links":{"cited_paper":"/paper/2210.01504","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:7b8ff87a0a771699a6534556be1b0f402f0fa84bbca574021c4c3f727d1ab5bc","observation_id":"ebc86268-dd95-4bda-9aab-b04964ea159d","resolution":{"observed_at":"2026-08-08T20:08:57.384769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:58.112615Z","title":"Deduplicating training data mitigates privacy risks in language models","venue":null,"work_id":"74580d96-145a-41bf-8c5b-9c436d307068","year":2022},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.389616Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:686067e82ef8234c5e3e322ab95c919647597f70e4ed0ca6c8c6703c5c2b03eb","observation_id":"170397e8-c715-4f70-ba57-81fbb3235fc2","resolution":{"observed_at":"2026-08-08T20:08:58.117084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13771","last_updated":"2023-10-20T19:14:59Z","snapshot_observed_at":"2026-07-06T16:36:23.513728Z","submitted_at":"2023-10-20T19:14:59Z","title":"Copyright Violations and Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13771","snapshot_observed_at":"2026-08-08T20:08:57.393267Z","title":"Copyright violations and large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.393267Z"},"links":{"cited_paper":"/paper/2310.13771","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:dc7d2ecaae4c3617eaa22c5906c1c0be95bfb003bbd534e4baeeb1730ef2dd01","observation_id":"2f45330f-b883-462a-8846-a0c872513e62","resolution":{"observed_at":"2026-08-08T20:08:57.393267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:58.100326Z","title":"Big-little decoder: Faster language generation with an auxiliary model","venue":null,"work_id":"b62ca654-bf0b-488f-b6cb-89e08d95403c","year":2023},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.396946Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:b6ff41f99e3334183569ccd67acf4ada6e3b7e43fd38cd669e7702fe2daffbf9","observation_id":"665d368c-3858-4c8c-8e26-762581105b80","resolution":{"observed_at":"2026-08-08T20:08:58.105232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:58.089340Z","title":"Fast inference from transformers via speculative decoding","venue":null,"work_id":"3a7cb2c9-a81a-4ca1-ac5a-3cc4911ea056","year":2023},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.401684Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:63bcda21c860a9bda118b46d1f5d3863da646568c43bae65193e69e14bb25c8a","observation_id":"df7f59d6-8712-41a5-a7c4-2f16c88bcb9d","resolution":{"observed_at":"2026-08-08T20:08:58.093558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:58.077939Z","title":"Contrastive decoding: Open-ended text generation as conditional density estimation","venue":null,"work_id":"5b63334d-a901-4137-91d0-30ba87b6d211","year":2022},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.405452Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:b83cc8c99100a43ea65c4a6e2886a8ad620aa1e8ddfcaff5dd7f143df47d9ff5","observation_id":"f90f4c37-637b-4061-80f9-90a6943510d2","resolution":{"observed_at":"2026-08-08T20:08:58.081975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-08T20:08:57.409176Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.409176Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:d3c15915ea4361c6213000552c1322b7da667b95857ec603747cff5f9f146f6d","observation_id":"7d5c5bf9-f9db-43e4-9c49-9eaaaac4dd13","resolution":{"observed_at":"2026-08-08T20:08:57.409176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"cs/0205028","last_updated":"2002-05-17T12:51:00Z","snapshot_observed_at":"2026-07-07T03:04:36.695497Z","submitted_at":"2002-05-17T12:51:00Z","title":"NLTK: The Natural Language Toolkit","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"cs/0205028","snapshot_observed_at":"2026-08-08T20:08:57.413302Z","title":"Nltk: The natural language toolkit","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.413302Z"},"links":{"cited_paper":"/paper/cs/0205028","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:2d07d20ea8fc699d34823a0f9f1907528f271d9896cc5cbee7654076896e41c1","observation_id":"b5bc4549-1fc4-48d5-9240-7018971984d9","resolution":{"observed_at":"2026-08-08T20:08:57.413302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09542","last_updated":"2023-07-18T18:36:29Z","snapshot_observed_at":"2026-08-01T15:25:14.552585Z","submitted_at":"2023-07-18T18:36:29Z","title":"Can Neural Network Memorization Be Localized?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09542","snapshot_observed_at":"2026-08-08T20:08:57.417863Z","title":"Can neural network memorization be localized? arXiv preprint arXiv:2307.09542, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.417863Z"},"links":{"cited_paper":"/paper/2307.09542","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:3752dbde1fb5d6346711f2671e53f306e07664fb91ff1e47e8b165984faa9d19","observation_id":"ff8e80df-79af-449c-9340-e2601a2b0dd3","resolution":{"observed_at":"2026-08-08T20:08:57.417863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02789","last_updated":"2018-09-08T11:47:16Z","snapshot_observed_at":"2026-08-08T02:19:52.596062Z","submitted_at":"2018-09-08T11:47:16Z","title":"Can a Suit of Armor Conduct Electricity? A New Dataset for Open Book Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02789","snapshot_observed_at":"2026-08-08T20:08:57.422630Z","title":"Can a suit of armor conduct electricity? a new dataset for open book question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.422630Z"},"links":{"cited_paper":"/paper/1809.02789","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:75549b4609ed88439dbcbdd700432f6b18a2261b978f174965aecd4c28fa752d","observation_id":"453f33d7-069c-401b-921b-9550b708f79e","resolution":{"observed_at":"2026-08-08T20:08:57.422630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12506","last_updated":"2022-11-04T03:13:41Z","snapshot_observed_at":"2026-08-06T14:39:03.092080Z","submitted_at":"2022-05-25T05:49:31Z","title":"Memorization in NLP Fine-tuning Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12506","snapshot_observed_at":"2026-08-08T20:08:57.426733Z","title":"Memorization in nlp fine-tuning methods","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.426733Z"},"links":{"cited_paper":"/paper/2205.12506","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:9a231fe95b8b1ce38fc045223897ef4331d59a418e4360bb81364d0c4dc904fc","observation_id":"4be2acd5-1f7b-41da-b179-f7aca784429b","resolution":{"observed_at":"2026-08-08T20:08:57.426733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17035","last_updated":"2023-11-28T18:47:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T18:47:03Z","title":"Scalable Extraction of Training Data from (Production) Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17035","snapshot_observed_at":"2026-08-08T20:08:57.430369Z","title":"Scalable extraction of training data from (production) language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.430369Z"},"links":{"cited_paper":"/paper/2311.17035","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:96cefe0f114c95cc70076d545c518f726ba752908c391f2a8b4b0788e0c7c056","observation_id":"4f427f2f-7094-4895-af91-af8225b2175a","resolution":{"observed_at":"2026-08-08T20:08:57.430369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:58.066458Z","title":"Scalable extraction of training data from aligned, production language models","venue":null,"work_id":"b786f03c-3056-4702-a8d3-c949492d6fe0","year":2025},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.434194Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:d576dd6f54c096f492ec3a02ddba48742557c4163afeecee716bb783a097b5e0","observation_id":"1ed45db8-3804-4be8-be55-6e093a165be9","resolution":{"observed_at":"2026-08-08T20:08:58.070573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:58.054676Z","title":"Generative ai and copyright issues globally: Ani media v openai","venue":null,"work_id":"4425604b-1381-4e12-937a-6bfd8cdf6c72","year":2025},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.438835Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:33026f964406298c53ee7765f22b256b51a891a43e2f66176cdf813280260dcd","observation_id":"47932ff0-966d-4c0d-815d-68511430a0aa","resolution":{"observed_at":"2026-08-08T20:08:58.059329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11985","last_updated":"2024-10-15T18:47:12Z","snapshot_observed_at":"2026-07-06T19:34:10.252984Z","submitted_at":"2024-10-15T18:47:12Z","title":"The Fair Language Model Paradox","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11985","snapshot_observed_at":"2026-08-08T20:08:57.442425Z","title":"The fair language model paradox","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.442425Z"},"links":{"cited_paper":"/paper/2410.11985","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:a5177efb8ad236328c470e5c812bc19d6f00f54217842b32fff74782e4c94971","observation_id":"70fa3916-a3f1-40c6-a62e-f33dbdbb5e3c","resolution":{"observed_at":"2026-08-08T20:08:57.442425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08707","last_updated":"2024-07-11T17:44:41Z","snapshot_observed_at":"2026-08-09T10:32:24.339157Z","submitted_at":"2024-07-11T17:44:41Z","title":"Extracting Training Data from Document-Based VQA Models","version":1},"cited_work":{"arxiv_id":"2407.08707","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.08707","snapshot_observed_at":"2026-08-08T20:08:57.645956Z","title":"Extracting Training Data from Document-Based VQA Models","venue":"cs.CV","work_id":"86ad6461-99df-427f-b2d2-6d6337ce0eef","year":2024},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.446287Z"},"links":{"cited_paper":"/paper/2407.08707","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:ed197775c8a186b512bec226d2eb8dd04210c8ef67b9d3368bf67b80d3fac0de","observation_id":"edd3352d-1ed9-4f08-a78f-fb7c65921c47","resolution":{"observed_at":"2026-08-08T20:08:57.650604Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15010","last_updated":"2025-06-12T10:12:38Z","snapshot_observed_at":"2026-08-08T00:48:28.063583Z","submitted_at":"2025-02-20T20:02:56Z","title":"Obliviate: Efficient Unmemorization for Protecting Intellectual Property in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.15010","snapshot_observed_at":"2026-08-08T20:08:57.451004Z","title":"Obliviate: Efficient unmemorization for protecting intellectual property in large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.451004Z"},"links":{"cited_paper":"/paper/2502.15010","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:709a2826cc5aedfbbd4a0d75e1e3ac3af5b335ba6920dacaf03d330881075da3","observation_id":"a6c2f15d-1476-443a-90d6-5cd8eb1b4817","resolution":{"observed_at":"2026-08-08T20:08:57.451004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:57.454704Z","title":"Winogrande: An adversarial winograd schema challenge at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.454704Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:94484acea4e879bd5579d4fdbede03edfd9d8b7032b2a67ce1479d8a1dc49f84","observation_id":"f079b7cc-6af9-4de8-bab4-67ab6fef6fd7","resolution":{"observed_at":"2026-08-08T20:08:57.454704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02159","last_updated":"2025-01-28T21:19:25Z","snapshot_observed_at":"2026-07-06T19:26:43.399756Z","submitted_at":"2024-10-03T02:53:51Z","title":"Mitigating Memorization In Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02159","snapshot_observed_at":"2026-08-08T20:08:57.457970Z","title":"Mitigating memorization in language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.457970Z"},"links":{"cited_paper":"/paper/2410.02159","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:cfefab5c392486484359bc55d97b53bb3260b5c3f31618e2bdbd1ca79d2207ca","observation_id":"b9c2bfa4-f079-4939-8372-0a2d0c15cf8d","resolution":{"observed_at":"2026-08-08T20:08:57.457970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:58.037586Z","title":"Distilbert, a distilled version of bert: smaller, faster, cheaper and lighter","venue":null,"work_id":"4c738a55-1d4f-4b6d-9c85-51d5f7da44d6","year":2019},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.461956Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:74afdcb4d605caa1853dd501a60351399a5a337666f58937724856fc48d3285a","observation_id":"2b8bbf0f-0763-46cd-afca-7141ce5e7945","resolution":{"observed_at":"2026-08-08T20:08:58.041547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09728","last_updated":"2019-09-09T17:29:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-04-22T05:36:37Z","title":"SocialIQA: Commonsense Reasoning about Social Interactions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09728","snapshot_observed_at":"2026-08-08T20:08:57.465476Z","title":"Socialiqa: Commonsense reasoning about social interactions","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.465476Z"},"links":{"cited_paper":"/paper/1904.09728","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:a28bf03063673b9dfa94630def60b36cf625c26c58137c175c89cbe283b5cb06","observation_id":"63e7a741-a1e4-444b-8c21-1ff00b81d8fe","resolution":{"observed_at":"2026-08-08T20:08:57.465476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15146","last_updated":"2024-11-11T19:47:16Z","snapshot_observed_at":"2026-07-06T18:04:26.177088Z","submitted_at":"2024-04-23T15:49:37Z","title":"Rethinking LLM Memorization through the Lens of Adversarial Compression","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15146","snapshot_observed_at":"2026-08-08T20:08:57.470379Z","title":"Rethinking llm memorization through the lens of adversarial compression","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.470379Z"},"links":{"cited_paper":"/paper/2404.15146","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:26913517b4a587ccdf1a9eb54c82c8dd47855573774d5caa6b87dbf7a64f983c","observation_id":"565692a6-1b0d-4ee9-bd2d-923e9b528af8","resolution":{"observed_at":"2026-08-08T20:08:57.470379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00106","last_updated":"2024-06-27T10:24:35Z","snapshot_observed_at":"2026-07-06T18:38:42.333605Z","submitted_at":"2024-06-27T10:24:35Z","title":"UnUnlearning: Unlearning is not sufficient for content regulation in advanced generative AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00106","snapshot_observed_at":"2026-08-08T20:08:57.474018Z","title":"Ununlearning: Unlearning is not sufficient for content regulation in advanced generative ai","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.474018Z"},"links":{"cited_paper":"/paper/2407.00106","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:00c901f48bc572f87d8c283dc762ae5c171562b83b23ac32541adb0d49846b0c","observation_id":"8feae682-7ffa-4ad0-8276-0a9d528e4b60","resolution":{"observed_at":"2026-08-08T20:08:57.474018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:57.477897Z","title":"Slimpajama: A 627b token cleaned and deduplicated version of redpajama, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.477897Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:8cb1e340af0e96be00cc67449b4c646c95b5e3f9e22e9b5000bc43156953ff6a","observation_id":"623241d4-a7c2-4651-af4e-a0236dcfee9f","resolution":{"observed_at":"2026-08-08T20:08:57.477897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:58.018406Z","title":"Blockwise parallel decoding for deep autoregressive models","venue":null,"work_id":"443a5259-e698-4f91-95dc-0c5a0149c2be","year":2018},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.482077Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:6bfe04ee57fa98172e912bcdaa412e0f7bbcead969addf79cea54017397b47f2","observation_id":"15894f9f-4382-49ce-8512-1eb64c032142","resolution":{"observed_at":"2026-08-08T20:08:58.022757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:58.005148Z","title":"Activation steering: Mitigating verbatim memorisation at inference time","venue":null,"work_id":"5c67bbc2-a565-450d-b4e2-d27df65cdfb9","year":2025},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.485474Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:bd8b2713a2e8c262873fb51b2d583937181113a963c62ebbbf5202e5984337e1","observation_id":"5c292de2-8bb3-43b4-a04f-2b1cca06b852","resolution":{"observed_at":"2026-08-08T20:08:58.010704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-08T20:08:57.488782Z","title":"Gemini: a family of highly capable multimodal models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.488782Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:2848a4286f3fcbcf73bcf4914727d46b171a2b417b649236c58a6d9a3c496cac","observation_id":"f4d851db-b509-484f-bc65-8f4584fcbddc","resolution":{"observed_at":"2026-08-08T20:08:57.488782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:57.492847Z","title":"Memorization without overfitting: Analyzing the training dynamics of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.492847Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:dd29b2fa807d1b41bdda6a9affa035b724b90dc89184f749a191a163e04c9068","observation_id":"07436a8c-e043-4a41-8d69-b03ddd45629d","resolution":{"observed_at":"2026-08-08T20:08:57.492847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02193","last_updated":"2025-07-28T00:57:26Z","snapshot_observed_at":"2026-08-07T16:13:16.898106Z","submitted_at":"2025-04-03T00:36:40Z","title":"More is Less: The Pitfalls of Multi-Model Synthetic Preference Data in DPO Safety Alignment","version":3},"cited_work":{"arxiv_id":"2504.02193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.02193","snapshot_observed_at":"2026-08-08T20:08:57.572211Z","title":"More is Less: The Pitfalls of Multi-Model Synthetic Preference Data in DPO Safety Alignment","venue":"cs.AI","work_id":"2930a518-108d-4c6d-b78d-ff2253fb431f","year":2025},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.496281Z"},"links":{"cited_paper":"/paper/2504.02193","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:dc8cde76b949732cf139e07058140ddb57027f4a5c890384273f2c010adf9e55","observation_id":"26fa64ab-eb27-4147-be49-ab9e4ec20298","resolution":{"observed_at":"2026-08-08T20:08:57.577008Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.12372","last_updated":"2024-11-19T09:35:28Z","snapshot_observed_at":"2026-08-06T21:35:45.662025Z","submitted_at":"2024-11-19T09:35:28Z","title":"RedPajama: an Open Dataset for Training Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.12372","snapshot_observed_at":"2026-08-08T20:08:57.500140Z","title":"Redpajama: an open dataset for training large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.500140Z"},"links":{"cited_paper":"/paper/2411.12372","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:bf783005590c428e9e15a5f81af052fe0bc36b73aa4896c32d03b3b85dbb3b4e","observation_id":"935cca9e-f840-4481-bfcd-ea0a1f113379","resolution":{"observed_at":"2026-08-08T20:08:57.500140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:57.984334Z","title":"Speculative decoding for non–autoregressive neural machine translation","venue":null,"work_id":"03b8c0aa-0975-4f5b-a06a-8a72129c2a5f","year":2023},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.503958Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:edf1494731d162f5cda650c21bc5460a960556c992bece8ab4cdfe3658d3e37b","observation_id":"9330b9f7-81af-4a33-863f-0bf068b527df","resolution":{"observed_at":"2026-08-08T20:08:57.989656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:57.969219Z","title":"Autonomous data selection with language models for mathematical texts","venue":null,"work_id":"ba79b7b1-58fe-4575-be50-10b1856965b3","year":2024},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.507808Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:88b93c728f1274bd872c455e14074328f5c11a67af37184b3b63dc79c319cd30","observation_id":"6c4494c2-3c03-4a81-b066-03fbe3dc81ad","resolution":{"observed_at":"2026-08-08T20:08:57.974016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:08:57.511375Z","title":"Judging llm-as-a-judge with mt-bench and chatbot arena","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.511375Z"},"links":{"citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:d3bfc02b7e51f08bb54bf5008d50ae0a1bfe3e3aec74ea67f1eea3ccdedc5e3f","observation_id":"d0a22b50-317f-4ca9-880d-f5a3ad805715","resolution":{"observed_at":"2026-08-08T20:08:57.511375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.15727","last_updated":"2023-11-05T13:44:55Z","snapshot_observed_at":"2026-08-08T16:09:07.565468Z","submitted_at":"2023-08-30T03:06:47Z","title":"Quantifying and Analyzing Entity-level Memorization in Large Language Models","version":2},"cited_work":{"arxiv_id":"2308.15727","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.15727","snapshot_observed_at":"2026-08-08T20:08:57.544161Z","title":"Quantifying and Analyzing Entity-level Memorization in Large Language Models","venue":"cs.CL","work_id":"3ea93a24-650b-407d-9d56-5c21a93b10c9","year":2023},"citing_paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-08T20:08:57.514936Z"},"links":{"cited_paper":"/paper/2308.15727","citing_paper":"/paper/2502.05159"},"observation_digest":"sha256:ca04da65e18da83d887ecbacb6ee8d0fb46fae7bf987d4534012bf08b2f7468b","observation_id":"51057508-22bd-47cd-981a-bb7996a563b3","resolution":{"observed_at":"2026-08-08T20:08:57.550482Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.05159","last_updated":"2025-05-27T16:54:17Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T00:02:45.829856Z","submitted_at":"2025-02-07T18:41:21Z","title":"A Lightweight Method to Disrupt Memorized Sequences in LLM"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":5,"verified_fuzzy":19},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 0 inbound Pith citation observations for arXiv:2502.05159."}