{"as_of":"2026-08-07T18:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8da8922ae8b2cc3c0ac00d8e7a99fe720da8da656d7fdb14cd2fcb2ac632579f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":51,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:37:25.072025Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":275,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-10T21:35:18.513342Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2101.00027"},"observation_digest":"sha256:40fa73959798280c688affc484f7a8e9be4cd35c8807bf35d492d9f23c7dd8db","observation_id":"1f249adc-febb-4812-a104-ac684d731332","resolution":{"observed_at":"2026-05-10T21:35:18.749655Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2107.06499","last_updated":"2022-03-24T19:29:45Z","snapshot_observed_at":"2026-08-05T18:30:13.997811Z","submitted_at":"2021-07-14T06:06:52Z","title":"Deduplicating Training Data Makes Language Models Better","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-24T13:36:55.210708Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2107.06499"},"observation_digest":"sha256:586a68c0b2ab23486d744f4f963cbee7e81b62eaacf7f53148218e4faf2b3f00","observation_id":"a001a767-4dd2-40a8-909e-e78e492c4507","resolution":{"observed_at":"2026-05-24T13:39:31.714001Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2112.04359","last_updated":"2021-12-08T16:09:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T16:09:48Z","title":"Ethical and social risks of harm from Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-11T18:24:28.835688Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2112.04359"},"observation_digest":"sha256:731f574b4b3f4488f23bd84f6954b6fa588f1aec51d45d4ef33411072f76185b","observation_id":"5d360aae-b923-4573-b2ad-60a12b397e5b","resolution":{"observed_at":"2026-05-11T18:24:29.952856Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2201.08239","last_updated":"2022-02-10T16:30:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-20T15:44:37Z","title":"LaMDA: Language Models for Dialog Applications","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-12T03:17:32.272353Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2201.08239"},"observation_digest":"sha256:f972b4483762cb8ff1298dc9175e7fb8e42b0c9cbeda1be0a8f1e00a8439813a","observation_id":"3da7c7d4-035e-4215-a99a-aa3bd6df49c2","resolution":{"observed_at":"2026-05-12T03:17:32.518336Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2202.07646","last_updated":"2023-03-06T06:28:18Z","snapshot_observed_at":"2026-08-03T19:51:05.627063Z","submitted_at":"2022-02-15T18:48:31Z","title":"Quantifying Memorization Across Neural Language Models","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T22:04:59.678438Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2202.07646"},"observation_digest":"sha256:52efc9e5e83dafd6b03c86dac0265f477156716b62c692250b5768c85c6543a0","observation_id":"0e12e445-3aea-4195-bc41-e52d725cb488","resolution":{"observed_at":"2026-05-13T22:04:59.731563Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2205.10487","last_updated":"2022-05-21T02:14:27Z","snapshot_observed_at":"2026-08-04T13:21:32.121470Z","submitted_at":"2022-05-21T02:14:27Z","title":"Scaling Laws and Interpretability of Learning from Repeated Data","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-17T15:52:40.335080Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2205.10487"},"observation_digest":"sha256:d77dcb743fd6bd4ca077e2f96c1a4fd1944f53a804cd17a6a7c6a36d859c08de","observation_id":"78f2a4f4-10c0-4085-a8cd-f4364edeca01","resolution":{"observed_at":"2026-05-17T15:52:40.461771Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2209.07858","last_updated":"2022-11-22T19:12:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-23T23:37:14Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-12T01:38:08.362920Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2209.07858"},"observation_digest":"sha256:72a3f3b6eafaceb97167eba792acca6e5b9fcb7d2276ab30c9da2b016fc2ff01","observation_id":"862123b6-3250-4082-8f30-c978da3b3fc5","resolution":{"observed_at":"2026-05-12T01:38:08.468054Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2301.11325","last_updated":"2023-01-26T18:58:53Z","snapshot_observed_at":"2026-07-06T14:45:00.730733Z","submitted_at":"2023-01-26T18:58:53Z","title":"MusicLM: Generating Music From Text","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T14:27:05.198402Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2301.11325"},"observation_digest":"sha256:7f657c06268d8107b8b834d7d438cecaa9452eea2a3b752d8002dcee157337d5","observation_id":"54ae7179-ff65-4628-80c9-4d5bd6586ed9","resolution":{"observed_at":"2026-05-13T14:27:06.256783Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2402.16391","last_updated":"2026-04-28T07:39:39Z","snapshot_observed_at":"2026-08-01T03:48:12.462157Z","submitted_at":"2024-02-26T08:31:45Z","title":"Industry Practitioners Perspectives on AI Model Quality: Perceptions, Challenges, and Solutions","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-24T04:21:49.775278Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2402.16391"},"observation_digest":"sha256:998e3d6934d90e95b34f7f3690696141fc913de3fcc78ef26c68b08a307f982e","observation_id":"ae0ef567-9f81-41fc-a125-e94baeaec035","resolution":{"observed_at":"2026-05-24T04:23:52.895916Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2403.07691","last_updated":"2024-03-14T07:47:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T14:34:08Z","title":"ORPO: Monolithic Preference Optimization without Reference Model","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-16T09:34:04.394588Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2403.07691"},"observation_digest":"sha256:ddb987b4e4f4fcb2120087f1eb6bb15ae8d5090d82d13d68e05ea1dbc73e6891","observation_id":"8fd242df-c7e3-41f4-83a3-3354df4306fa","resolution":{"observed_at":"2026-05-16T09:34:04.740850Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2501.02407","last_updated":"2026-05-20T14:04:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-05T00:03:18Z","title":"Towards the Anonymization of the Language Modeling","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-23T06:28:16.975305Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2501.02407"},"observation_digest":"sha256:382dc3428745f434b4df7ef5fbad0571b390076e3d5e2a54e284b0e4d9b51634","observation_id":"07b45183-d87e-42d3-aee1-ba78389b23f1","resolution":{"observed_at":"2026-05-23T06:32:39.434987Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"reference_index":253,"source":"arxiv_source","source_observed_at":"2026-05-17T02:11:36.932541Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2502.03387"},"observation_digest":"sha256:9a3c7505409b2db03c047f8b1a0f6765d20a3acbd4c59e53b96b3105336afdad","observation_id":"62fcb607-fd74-4d3c-ad40-67c0d7f50894","resolution":{"observed_at":"2026-05-17T02:11:37.303275Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-07T15:37:25.072025Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14585","last_updated":"2025-09-04T11:31:24Z","snapshot_observed_at":"2026-08-07T15:29:34.665756Z","submitted_at":"2025-05-20T16:40:09Z","title":"Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:25.072025Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2505.14585"},"observation_digest":"sha256:0b4a468a5f506db37fee94780f56535db15f13a0cabac498ecfc37e51dced012","observation_id":"73256e9c-8ad7-463d-8010-e673d7e5b027","resolution":{"observed_at":"2026-08-07T15:37:25.072025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2505.18853","last_updated":"2026-05-15T15:40:33Z","snapshot_observed_at":"2026-07-06T21:29:55.740715Z","submitted_at":"2025-05-24T20:02:14Z","title":"Smoothie: Smoothing Diffusion on Token Embeddings for Text Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-22T01:34:21.657999Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2505.18853"},"observation_digest":"sha256:236142cf112452d13d54cbbd8e0b2d2e531daf0e03a4a753b7201a7e46bee4ba","observation_id":"65626d80-068e-4c69-a336-5968e501f862","resolution":{"observed_at":"2026-05-22T01:34:30.348594Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-06T23:58:58.403904Z","title":"Extracting training data from large language models, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:58.403904Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:27278043d8987d4fa93f0d0273c609b584f633c7ec2ecbef25b0ddbb0d2df3c0","observation_id":"63487873-dc3e-4722-88fe-87cac685c658","resolution":{"observed_at":"2026-08-06T23:58:58.403904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-06T23:49:10.559721Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.16170","last_updated":"2025-08-15T18:12:41Z","snapshot_observed_at":"2026-08-06T23:41:50.610962Z","submitted_at":"2025-06-19T09:44:25Z","title":"From Teacher to Student: Tracking Memorization Through Model Distillation","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T23:49:10.559721Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2506.16170"},"observation_digest":"sha256:6c9dc6c4ebe700384af8ba3f270cab21454e9707d76dc5aba7e6f70d41093ace","observation_id":"337899db-b046-4a2b-9411-196bf7d67a2e","resolution":{"observed_at":"2026-08-06T23:49:10.559721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-06T20:44:58.634485Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.01844","last_updated":"2025-07-02T15:58:51Z","snapshot_observed_at":"2026-08-06T20:39:18.983264Z","submitted_at":"2025-07-02T15:58:51Z","title":"Low-Perplexity LLM-Generated Sequences and Where To Find Them","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T20:44:58.634485Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2507.01844"},"observation_digest":"sha256:02981a16ec4b40e16db0f8947474475a20653be16e912fb5e317c183706a43b8","observation_id":"42bf4c06-3c92-4a00-9aa0-b9d9be79d119","resolution":{"observed_at":"2026-08-06T20:44:58.634485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-06T19:48:55.141023Z","title":"Extracting Training Data from Large Language Models,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.04478","last_updated":"2025-07-06T17:24:17Z","snapshot_observed_at":"2026-08-06T19:44:21.745673Z","submitted_at":"2025-07-06T17:24:17Z","title":"Model Inversion Attacks on Llama 3: Extracting PII from Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:48:55.141023Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2507.04478"},"observation_digest":"sha256:0a692eb14e4c1aff2c777a91fa7f12439a676bfec3f9e84b77b40b448aaf292a","observation_id":"6ea55d67-c336-4e53-831c-47d55a3e9ae5","resolution":{"observed_at":"2026-08-06T19:48:55.141023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-06T19:31:00.983161Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.05441","last_updated":"2025-07-07T19:45:46Z","snapshot_observed_at":"2026-08-06T19:23:56.565594Z","submitted_at":"2025-07-07T19:45:46Z","title":"Adversarial Machine Learning Attacks on Financial Reporting via Maximum Violated Multi-Objective Attack","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:31:00.983161Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2507.05441"},"observation_digest":"sha256:4e2f247d4097a93ff4a2ce5cb610d2a7f1ce466bd55b9a402687edd9e330d11b","observation_id":"e941e346-f608-4269-aa6c-193a4c956cbc","resolution":{"observed_at":"2026-08-06T19:31:00.983161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-06T17:35:00.426132Z","title":"Extracting training data from large language models, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.10536","last_updated":"2025-07-14T17:57:08Z","snapshot_observed_at":"2026-08-06T17:26:09.927608Z","submitted_at":"2025-07-14T17:57:08Z","title":"On the Performance of Differentially Private Optimization with Heavy-Tail Class Imbalance","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:35:00.426132Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2507.10536"},"observation_digest":"sha256:ecf04aea5a26f32164ea4ebdb7913a03a3005610b5a2af9c632027468c7a7486","observation_id":"77948df8-f2ae-4a6a-9eeb-3f0a4ab7d5c2","resolution":{"observed_at":"2026-08-06T17:35:00.426132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-06T15:46:55.618154Z","title":"Extracting training data from large language models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.15104","last_updated":"2026-06-15T19:35:17Z","snapshot_observed_at":"2026-08-06T23:38:35.977969Z","submitted_at":"2025-07-20T19:57:07Z","title":"AnalogFed: Privacy-Preserving Discovery of Analog Circuits at Scale with Federated Generative AI","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T15:46:55.618154Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2507.15104"},"observation_digest":"sha256:d9191ef598f150dff5da657cce2c7f81afd044a74e6ba4d6fe252d3d3ccb80a4","observation_id":"aa9c0ed5-5f41-4d48-941c-dccbe7fe0fdc","resolution":{"observed_at":"2026-08-06T15:46:55.618154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T20:31:43.822425Z","title":"Extracting training data from large language models","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2508.10404","last_updated":"2025-08-14T07:12:44Z","snapshot_observed_at":"2026-08-07T14:42:27.926127Z","submitted_at":"2025-08-14T07:12:44Z","title":"Layer-Wise Perturbations via Sparse Autoencoders for Adversarial Text Generation","version":1},"reference_index":118,"source":"pdf_text","source_observed_at":"2026-08-05T20:31:43.822425Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2508.10404"},"observation_digest":"sha256:877b3599887b42067ade6655a54b3b291e9c742114c665269e00450bcbd0ce08","observation_id":"45843fde-c633-4720-a317-5c86e2576e11","resolution":{"observed_at":"2026-08-05T20:31:43.822425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T16:50:19.605008Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.17767","last_updated":"2025-09-13T01:49:58Z","snapshot_observed_at":"2026-08-06T11:47:39.038660Z","submitted_at":"2025-08-25T08:04:20Z","title":"ISACL: Internal State Analyzer for Copyrighted Training Data Leakage","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T16:50:19.605008Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2508.17767"},"observation_digest":"sha256:7b4e5082fa6bfda668d5cfb1d480c7ef82acdd6653791b6b001db6b7808d4774","observation_id":"cd504875-9749-41af-a9f8-8cfebb784e8d","resolution":{"observed_at":"2026-08-05T16:50:19.605008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T15:09:03.247046Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2508.20452","last_updated":"2025-08-28T05:57:47Z","snapshot_observed_at":"2026-08-06T16:29:22.774856Z","submitted_at":"2025-08-28T05:57:47Z","title":"Evaluating Differentially Private Generation of Domain-Specific Text","version":1},"reference_index":2650,"source":"pdf_text","source_observed_at":"2026-08-05T15:09:03.247046Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2508.20452"},"observation_digest":"sha256:dfe89199272c8e144df22a87688f13bd41727227c1f7cd8a3a4baae6a4d21cb6","observation_id":"5a4074d2-053f-4fce-b7a7-fa03fb5fe38e","resolution":{"observed_at":"2026-08-05T15:09:03.247046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T04:46:41.159734Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.07022","last_updated":"2025-09-07T08:43:39Z","snapshot_observed_at":"2026-08-06T03:39:54.422946Z","submitted_at":"2025-09-07T08:43:39Z","title":"Preventing Another Tessa: Modular Safety Middleware For Health-Adjacent AI Assistants","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T04:46:41.159734Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2509.07022"},"observation_digest":"sha256:206456f9836d14463614c79cc78988f8071685fcae29786b884601df487d2bca","observation_id":"178f3650-d0a3-4e33-8ccd-087eef77de7b","resolution":{"observed_at":"2026-08-05T04:46:41.159734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2509.14594","last_updated":"2026-05-07T08:05:08Z","snapshot_observed_at":"2026-07-31T18:59:02.315833Z","submitted_at":"2025-09-18T03:57:50Z","title":"SynBench: A Benchmark for Differentially Private Text Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-18T16:46:22.479895Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2509.14594"},"observation_digest":"sha256:d5488f604d0929fa006f5c2747a26ba6c1f5f0a611670c62024f4c37c2879dfe","observation_id":"ffe1c536-0a58-4f78-b42e-25b0318b13be","resolution":{"observed_at":"2026-05-18T16:46:37.468783Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2512.08875","last_updated":"2026-05-08T19:19:07Z","snapshot_observed_at":"2026-08-07T07:00:38.303140Z","submitted_at":"2025-12-09T18:06:31Z","title":"When Tables Leak: Attacking String Memorization in LLM-Based Tabular Data Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T23:47:31.667427Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2512.08875"},"observation_digest":"sha256:c0493fef823e12e5dec90231e2e56ab7ac20347dfe4b49f44905304cad78b027","observation_id":"1b70cc15-f9fc-40f1-864b-0fc5c61e68b4","resolution":{"observed_at":"2026-05-16T23:48:41.851547Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2604.05872","last_updated":"2026-04-07T13:29:34Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T13:29:34Z","title":"Swiss-Bench 003: Evaluating LLM Reliability and Adversarial Security for Swiss Regulatory Contexts","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T19:44:26.931344Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2604.05872"},"observation_digest":"sha256:e26808251d291dc06e4e4dabc729484113a4266a7b4c27120a9717c9a7fbe5fa","observation_id":"a00801a1-c0c0-4373-9b48-aa540bf3dae9","resolution":{"observed_at":"2026-05-10T22:35:48.805002Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2604.21571","last_updated":"2026-04-23T11:51:31Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T11:51:31Z","title":"Separable Expert Architecture: Toward Privacy-Preserving LLM Personalization via Composable Adapters and Deletable User Proxies","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-09T22:26:34.487400Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2604.21571"},"observation_digest":"sha256:1b6c70d71975444fb77aa8ef915b03494a933a83e412f95b3183b048c12da4dd","observation_id":"6dc63095-16dc-4a9c-bda3-7ae3027a0fea","resolution":{"observed_at":"2026-05-09T22:34:07.373969Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2604.23338","last_updated":"2026-05-06T17:17:02Z","snapshot_observed_at":"2026-08-06T19:46:39.219000Z","submitted_at":"2026-04-25T14:57:15Z","title":"A Systematic Survey of Security Threats and Defenses in LLM-Based AI Agents: A Layered Attack Surface Framework","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-08T07:53:13.746141Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2604.23338"},"observation_digest":"sha256:d918ebbf349ce42489db2752c378ceccdfd765940b05b6d010f190c2840e0417","observation_id":"5b4fee91-8675-4ad1-9c0a-12203b86194f","resolution":{"observed_at":"2026-05-11T20:51:09.389604Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2604.25200","last_updated":"2026-04-28T04:10:04Z","snapshot_observed_at":"2026-07-06T23:11:07.254460Z","submitted_at":"2026-04-28T04:10:04Z","title":"Making AI-Assisted Grant Evaluation Auditable without Exposing the Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-07T16:12:20.534893Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2604.25200"},"observation_digest":"sha256:ebaa12290ce72dcf7ecfe74b725cb857ae7f66fc111b67689999a1a3e4e2570c","observation_id":"89517f86-bac3-429d-b231-14029185edba","resolution":{"observed_at":"2026-05-11T23:51:17.879632Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2605.06865","last_updated":"2026-05-07T19:06:35Z","snapshot_observed_at":"2026-07-06T23:19:15.382283Z","submitted_at":"2026-05-07T19:06:35Z","title":"Dataset Watermarking for Closed LLMs with Provable Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-11T00:53:42.185498Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2605.06865"},"observation_digest":"sha256:862b5a78496c3fe4e8fdb36f96b63ec670453f60e3c8064fc87754af07d9d095","observation_id":"4f74794c-9c4d-4e90-b0d3-ef5718da6854","resolution":{"observed_at":"2026-05-11T05:00:57.288375Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2605.22786","last_updated":"2026-05-21T17:42:12Z","snapshot_observed_at":"2026-07-06T23:33:04.856017Z","submitted_at":"2026-05-21T17:42:12Z","title":"LCGuard: Latent Communication Guard for Safe KV Sharing in Multi-Agent Systems","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T04:58:37.780195Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2605.22786"},"observation_digest":"sha256:6dc7dca174e4405a698d78572d79e5eb177662f2b214f9cc4b09194cd05748cf","observation_id":"57b34014-a152-497f-914f-558789c1199b","resolution":{"observed_at":"2026-05-22T05:01:05.960115Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2605.25902","last_updated":"2026-06-02T12:10:15Z","snapshot_observed_at":"2026-08-06T08:37:43.958488Z","submitted_at":"2026-05-25T14:29:36Z","title":"Reading the Finetuning Prior: Verbatim Content Recovery via Contrastive Decoding Diffing","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-29T22:37:02.708284Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2605.25902"},"observation_digest":"sha256:c235afed53ee1057bd7e111122ffd38514f0705ef499ed10cf0e4b75ae3e7d45","observation_id":"f9fbb4f0-4061-4a72-9d45-69a78e5d0c7e","resolution":{"observed_at":"2026-06-29T22:44:01.664060Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2605.27825","last_updated":"2026-05-27T01:31:40Z","snapshot_observed_at":"2026-08-02T19:56:32.199762Z","submitted_at":"2026-05-27T01:31:40Z","title":"MRMMIA: Membership Inference Attacks on Memory in Chat Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T12:04:53.511344Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2605.27825"},"observation_digest":"sha256:36424f3dff6505f2224ee815f1a90a2d21760db7dfb01c0b9992240419541ffa","observation_id":"40c45581-7f6a-4603-a973-ad6231aaf9b3","resolution":{"observed_at":"2026-06-29T12:13:27.072292Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2606.02822","last_updated":"2026-06-01T19:39:25Z","snapshot_observed_at":"2026-07-06T23:43:07.940839Z","submitted_at":"2026-06-01T19:39:25Z","title":"Which Defense Closes Which Threat? Attributing OWASP-LLM-Top-10 Coverage and Its Brittleness Under Paraphrasing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T13:49:47.542697Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2606.02822"},"observation_digest":"sha256:18d91fa7c239223331aaf8fdc6c449c4f3cae4c1f1e633db8c0f433f63b97ca8","observation_id":"d64b9315-cf10-4cbb-b788-e426d461e0a9","resolution":{"observed_at":"2026-07-01T23:56:23.234607Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2606.05936","last_updated":"2026-06-04T09:38:55Z","snapshot_observed_at":"2026-07-06T23:45:51.910263Z","submitted_at":"2026-06-04T09:38:55Z","title":"Epistemic Injustice in Language Models: An Audit of Pretraining Filters and Guardrails","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T02:06:31.341519Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2606.05936"},"observation_digest":"sha256:cd36bef0ed2e488a699111684a716090099a7dcb8f2e11b3f6fa98c3456b8d85","observation_id":"1468ffd0-0d5b-4fbc-8846-251fc95b7cbf","resolution":{"observed_at":"2026-07-02T12:26:57.057543Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2606.06286","last_updated":"2026-06-04T15:25:24Z","snapshot_observed_at":"2026-08-05T07:06:45.210601Z","submitted_at":"2026-06-04T15:25:24Z","title":"LLMs Can Leak Training Data But Do They Want To? A Propensity-Aware Evaluation of Memorization in LLMs","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-28T01:40:53.284131Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2606.06286"},"observation_digest":"sha256:ebe1a3f7457126bb74c2860935d9652095c9290b505bed1e89f061d46236f896","observation_id":"80ad5aa8-0703-40ed-8ccb-81d3bd7d3de1","resolution":{"observed_at":"2026-07-02T12:56:57.468052Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2606.07996","last_updated":"2026-06-06T06:27:54Z","snapshot_observed_at":"2026-07-31T22:22:12.944552Z","submitted_at":"2026-06-06T06:27:54Z","title":"MC-PDD: Masked Corpus-Level Pretraining Data Detection for Black-Box Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T20:02:50.169589Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2606.07996"},"observation_digest":"sha256:d898226c6c48e7af4e3626f3fbb7bc4926e8896ad14bc3b4f495bab26b53045b","observation_id":"f30c694f-27ce-46d4-9fc0-2cd79110ae11","resolution":{"observed_at":"2026-07-02T20:57:23.357949Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2606.09038","last_updated":"2026-06-08T05:10:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-08T05:10:05Z","title":"Personalization Meets Safety:Mechanisms,Risks,and Mitigations in Personalized LLMs","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-06-27T16:49:14.243931Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2606.09038"},"observation_digest":"sha256:31ae3b157aaab33adc100347f3f2ece2c63f64162b31ac06067045e288784197","observation_id":"b6dac66e-c769-457e-8edf-e64ccde2034f","resolution":{"observed_at":"2026-07-03T01:07:30.231259Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2606.09844","last_updated":"2026-04-26T18:38:46Z","snapshot_observed_at":"2026-07-06T23:49:08.412079Z","submitted_at":"2026-04-26T18:38:46Z","title":"The Interlocutor Effect: Why LLMs Leak More Personal Data to Agents Than Humans","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-01T09:00:23.558245Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2606.09844"},"observation_digest":"sha256:3cc8df2dea79019a6f78963819b149fcbdc5346c2b11ab312feae6b2ba705f06","observation_id":"e2d36494-b0a8-4b0d-8507-d9c8ae0a36cb","resolution":{"observed_at":"2026-07-01T09:05:36.687299Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2606.12341","last_updated":"2026-06-10T17:13:35Z","snapshot_observed_at":"2026-07-06T23:51:17.719874Z","submitted_at":"2026-06-10T17:13:35Z","title":"OCELOT: Inference-Leakage Budgets for Privacy-Preserving LLM Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T09:11:42.204778Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2606.12341"},"observation_digest":"sha256:9d35857bdee53849e8f7a4ea25c2d61dd4f5b829dfc693ae5346c113d9ff7021","observation_id":"48cfd250-1281-4f89-a3b2-72bd4189fdcf","resolution":{"observed_at":"2026-07-03T11:58:06.926713Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2606.17168","last_updated":"2026-06-20T10:01:32Z","snapshot_observed_at":"2026-07-06T23:52:47.494791Z","submitted_at":"2026-06-15T18:06:59Z","title":"RepSelect: Robust LLM Unlearning via Representation Selectivity","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-27T03:34:32.388152Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2606.17168"},"observation_digest":"sha256:748404b433d9d4396579f4781ce118515b8b15bf644b313c885021bf32b871ac","observation_id":"fb4f126f-1954-4a98-80d7-4e31d24dede2","resolution":{"observed_at":"2026-07-03T17:58:47.182482Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2606.23276","last_updated":"2026-06-24T01:41:10Z","snapshot_observed_at":"2026-08-03T00:58:42.253085Z","submitted_at":"2026-06-22T12:53:54Z","title":"Exposing the Illusion of Erasure in Knowledge Editing for LLMs","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T09:10:39.422141Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2606.23276"},"observation_digest":"sha256:d98e8499727723d8230afc9fb2f2d87b2b40c3c141253007b46e712ca9639991","observation_id":"99fef884-5b0d-4d97-9e02-13ed9e2c4cf6","resolution":{"observed_at":"2026-07-04T10:09:44.276219Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2606.26627","last_updated":"2026-06-25T05:44:18Z","snapshot_observed_at":"2026-08-02T09:36:56.612724Z","submitted_at":"2026-06-25T05:44:18Z","title":"Agents That Know Too Much: A Data-Centric Survey of Privacy in LLM Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T04:29:16.386339Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2606.26627"},"observation_digest":"sha256:578b2bf886e5608cf2c595735c9328d7f50ba4569252a6fb445258550293e6e3","observation_id":"ec1a872e-ec30-4beb-b1a3-9eb6d7dd83c7","resolution":{"observed_at":"2026-07-04T14:09:53.281660Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2607.00527","last_updated":"2026-07-03T14:06:15Z","snapshot_observed_at":"2026-07-12T09:30:07.403501Z","submitted_at":"2026-07-01T07:16:11Z","title":"AI Native Games: A Survey and Roadmap","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-07-02T12:59:20.908659Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2607.00527"},"observation_digest":"sha256:a5a3ff2e8d5d2980781edd5ae3111928d8fb9f4cbb039a28251dc1cf61690ce7","observation_id":"ffdbb1a8-433a-472a-900d-5d4097d0fa7d","resolution":{"observed_at":"2026-07-02T13:06:58.758903Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-07-12T09:30:07.729486Z","title":"Available: https://arxiv.org/abs/2012.07805","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.00527","last_updated":"2026-07-03T14:06:15Z","snapshot_observed_at":"2026-07-12T09:30:07.403501Z","submitted_at":"2026-07-01T07:16:11Z","title":"AI Native Games: A Survey and Roadmap","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-07-12T09:30:07.729486Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2607.00527"},"observation_digest":"sha256:f0035c4ab8141986f2dfb2ab0e24eaba1e9b2cc255b25d734e7ab9ead58db7d4","observation_id":"4d8c8d02-19f8-4a42-88a7-cde6e538eab4","resolution":{"observed_at":"2026-07-12T09:30:07.729486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":"2012.07805","doi":"10.48550/arxiv.2012.07805","metadata_source":"arxiv_reference","pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Brown, Dawn Song, Úlfar Er- lingsson, Alina Oprea, and Colin Raffel","venue":"arXiv (Cornell University)","work_id":"25b490c3-532b-40ec-b8ce-05fef84201d4","year":2021},"citing_paper":{"arxiv_id":"2607.00605","last_updated":"2026-07-01T08:30:28Z","snapshot_observed_at":"2026-08-01T23:01:34.713435Z","submitted_at":"2026-07-01T08:30:28Z","title":"Auditing Forgetting in Limited Memory Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-02T13:09:34.491580Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2607.00605"},"observation_digest":"sha256:d6bed69816b4b31848107262d00569c2236158045a4aa0f19e986c6ac3b0f576","observation_id":"41d6405e-1aa9-43f1-8a6a-e244df868e0e","resolution":{"observed_at":"2026-07-02T13:16:58.312170Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-01T14:11:43.482286Z","title":"Nicholas Carlini, Steve Chien, Milad Nasr, Shuang Song, Andreas Terzis, and Florian Tramer","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.19442","last_updated":"2026-07-21T08:59:54Z","snapshot_observed_at":"2026-08-07T14:23:11.137618Z","submitted_at":"2026-07-21T08:59:54Z","title":"Unlearning as Distribution Restoration: A Controlled Counterfactual Study, a Validated Selective Screen, and the Limits of Oracle-Free Certification","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T14:11:43.482286Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2607.19442"},"observation_digest":"sha256:0e3d1442fada4fd3c278a3a1c6bf02ee5a9c699b7a62bb9dfa0315c21088509f","observation_id":"724b7aaa-782d-4928-b56a-e74cdf712e32","resolution":{"observed_at":"2026-08-01T14:11:43.482286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-07-31T23:33:49.808882Z","title":"arXiv preprint arXiv:2012.07805 , year=","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.23934","last_updated":"2026-07-27T02:11:58Z","snapshot_observed_at":"2026-08-07T14:21:47.373100Z","submitted_at":"2026-07-27T02:11:58Z","title":"DECAF: De-Clustering for Adaptive Representational Unlearning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-31T23:33:49.808882Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2607.23934"},"observation_digest":"sha256:21f9f90ea1f7f5dc85a5ec6d5f630e98de99759ad94330ef8bf5e493cc0db2a7","observation_id":"9c1c3df4-b145-41bb-a08f-62af760ed21c","resolution":{"observed_at":"2026-07-31T23:33:49.808882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-01T02:28:36.726398Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.25451","last_updated":"2026-07-28T08:41:31Z","snapshot_observed_at":"2026-08-05T00:48:38.387718Z","submitted_at":"2026-07-28T08:41:31Z","title":"Bits and Memories: Measuring Verbatim Extraction Across LLM Quantization","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-01T02:28:36.726398Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2607.25451"},"observation_digest":"sha256:72f77a90b398067de62ea7ccd19d9d7240485f977713e467025deebdff0c5cc1","observation_id":"c08c5f00-e512-4bec-91e8-c1bbee4adaf8","resolution":{"observed_at":"2026-08-01T02:28:36.726398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2012.07805/citation-record","integrity":"/paper/2012.07805/integrity","json":"/paper/2012.07805/citation-record.json","paper":"/paper/2012.07805"},"outbound":[],"paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","latest_version":2,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 51 inbound Pith citation observations for arXiv:2012.07805."}