{"as_of":"2026-08-20T02:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:de5a7ae3280e7afa984e2efd35ee9b26d892589d69fcf23bbdfe99058fd2e910","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T15:09:50.778525Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:21:33.766535Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-15T14:15:55.154579Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.11302","snapshot_observed_at":"2026-08-06T17:21:33.766535Z","title":"arXiv:2412.11302 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11128","last_updated":"2025-07-15T09:28:44Z","snapshot_observed_at":"2026-08-11T10:44:57.901509Z","submitted_at":"2025-07-15T09:28:44Z","title":"What Should LLMs Forget? Quantifying Personal Data in LLMs for Right-to-Be-Forgotten Requests","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T17:21:33.766535Z"},"links":{"cited_paper":"/paper/2412.11302","citing_paper":"/paper/2507.11128"},"observation_digest":"sha256:e8d4524ce809ab02abab68b3123eb763d881ff3e84c33b378d6134020ab36dc9","observation_id":"1bca4c09-851c-4338-ba73-ae22ed7760f4","resolution":{"observed_at":"2026-08-06T17:21:33.766535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"cited_work":{"arxiv_id":"2412.11302","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.11302","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sequence-level leakage risk of training data in large language models","venue":null,"work_id":"099b76f8-1b2b-4beb-aa35-8345cb653802","year":2024},"citing_paper":{"arxiv_id":"2603.09002","last_updated":"2026-04-26T14:13:48Z","snapshot_observed_at":"2026-08-14T21:45:56.224919Z","submitted_at":"2026-03-09T22:46:27Z","title":"Security Considerations for Multi-agent Systems","version":2},"reference_index":241,"source":"pdf_text","source_observed_at":"2026-05-15T14:12:14.160789Z"},"links":{"cited_paper":"/paper/2412.11302","citing_paper":"/paper/2603.09002"},"observation_digest":"sha256:28c924f5397735d407ac18dd8ca1849edd44236fe33b6948d2d7a1ff7fd7fb73","observation_id":"3451d5e0-9f5a-4f23-87fe-29db27f6e25f","resolution":{"observed_at":"2026-05-15T14:15:55.156674Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.11302","snapshot_observed_at":"2026-08-02T02:44:26.834349Z","title":"Edward Suh , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14242","last_updated":"2026-07-15T18:03:08Z","snapshot_observed_at":"2026-08-14T09:53:27.449814Z","submitted_at":"2026-07-15T18:03:08Z","title":"Implicit Reasoning Steering via Concept Chaining","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-02T02:44:26.834349Z"},"links":{"cited_paper":"/paper/2412.11302","citing_paper":"/paper/2607.14242"},"observation_digest":"sha256:2e936849ba05ee126f67cb4ee4d36d1176346d883acdce17f460251ba6d76035","observation_id":"300dba33-ed9d-4f03-b3b9-860171231052","resolution":{"observed_at":"2026-08-02T02:44:26.834349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.11302","snapshot_observed_at":"2026-08-02T02:44:35.811486Z","title":"Edward Suh","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14242","last_updated":"2026-07-15T18:03:08Z","snapshot_observed_at":"2026-08-14T09:53:27.449814Z","submitted_at":"2026-07-15T18:03:08Z","title":"Implicit Reasoning Steering via Concept Chaining","version":1},"reference_index":167,"source":"arxiv_source","source_observed_at":"2026-08-02T02:44:35.811486Z"},"links":{"cited_paper":"/paper/2412.11302","citing_paper":"/paper/2607.14242"},"observation_digest":"sha256:1b66d36c30d8ec68f2a25b82011ed23bbe20cc565f4983bda441b3997b5e14b4","observation_id":"d2b4187d-9b88-4266-ab9e-01d5497c9ee6","resolution":{"observed_at":"2026-08-02T02:44:35.811486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.11302/citation-record","integrity":"/paper/2412.11302/integrity","json":"/paper/2412.11302/citation-record.json","paper":"/paper/2412.11302"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:09:50.628972Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.628972Z"},"links":{"citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:674de5c4da0bdd9b938c74a012a82bb36c25e4e528266727e25fcf9eaa899fdc","observation_id":"29208af9-e6e5-4574-b99e-dc4c3f738315","resolution":{"observed_at":"2026-08-11T15:09:50.628972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:09:51.221506Z","title":"C hat M istral","venue":null,"work_id":"c9bb9651-d3d7-4737-b779-e9c8de6f92a9","year":2023},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.636028Z"},"links":{"citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:cb0b37b6c00526cb911f4fe733b06a37d62eac6d03be05876b4e338aad380dd1","observation_id":"32ce6619-ad7d-4c6c-8e5a-09ba5d0d2aef","resolution":{"observed_at":"2026-08-11T15:09:51.229009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:09:51.205034Z","title":null,"venue":null,"work_id":"cad3e7a9-ebd7-47f7-a3cf-32a95ae8a8da","year":2023},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.645721Z"},"links":{"citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:f82b617d76b76811a014ec5dbd2c69d3955a7a8cc93d48020993ce866158ee1d","observation_id":"5730a92f-fd00-4696-a31c-700fc446bc91","resolution":{"observed_at":"2026-08-11T15:09:51.210913Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:09:51.186747Z","title":"Emergent and predictable memorization in large language models","venue":null,"work_id":"8eed4002-0759-42da-b7af-90f182d6d719","year":2024},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.651308Z"},"links":{"citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:df2a2f4d86e95df29270495470634b5e3ae4768a2975162c8ab946a3971d8043","observation_id":"a7c518e0-fe5a-472e-967b-bf9fd6590712","resolution":{"observed_at":"2026-08-11T15:09:51.192501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:09:51.166612Z","title":"The secret sharer: Evaluating and testing unintended memorization in neural networks","venue":null,"work_id":"a4707177-40a5-47a7-acb7-630ed0aec4c2","year":2019},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.659687Z"},"links":{"citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:725316c2eecd73a63afc657efe9780b8f1edfacedd485aadf114e52b244f3dc8","observation_id":"d1dd711d-cdaf-457f-a00f-c2b6314803ac","resolution":{"observed_at":"2026-08-11T15:09:51.174257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:09:50.667920Z","title":"Extracting training data from large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.667920Z"},"links":{"citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:8c7e161fa147921fd49b7556a1e49321d9bc6ba9d69dfe1090e3615829184fdf","observation_id":"5efedde3-1c84-46c0-9852-0adf52c583c8","resolution":{"observed_at":"2026-08-11T15:09:50.667920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:09:51.136338Z","title":"Quantifying memorization across neural language models","venue":null,"work_id":"7c918c62-7d61-497b-8cd7-a7369efe91ba","year":2022},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.673629Z"},"links":{"citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:db88df567e05d5f10f0d23b70ffcc82445197ebdffc09f0ca7ba67e1090b80d1","observation_id":"15512697-6a4c-4017-8c1d-4a218d5fba9f","resolution":{"observed_at":"2026-08-11T15:09:51.142214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:09:51.118709Z","title":null,"venue":null,"work_id":"ca9d2024-bef9-45bc-ae85-7505a2e8f791","year":2019},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.678274Z"},"links":{"citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:d70e21307bda4764b36d607c34ba513a8ac30127d596d7cb285341cc20098c9b","observation_id":"a6143e59-c360-4aa8-bc25-f967fad68b7e","resolution":{"observed_at":"2026-08-11T15:09:51.124399Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07841","last_updated":"2024-09-16T13:18:23Z","snapshot_observed_at":"2026-08-16T14:19:15.347006Z","submitted_at":"2024-02-12T17:52:05Z","title":"Do Membership Inference Attacks Work on Large Language Models?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07841","snapshot_observed_at":"2026-08-11T15:09:50.684310Z","title":"Do membership inference attacks work on large language models? arXiv preprint arXiv:2402.07841, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.684310Z"},"links":{"cited_paper":"/paper/2402.07841","citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:e6091d9b9bc5e5e53e57ec9ed4365a36bdce6f5791b9df869e436480039735cd","observation_id":"0ef7962d-0d84-4b6b-81ee-79404630f759","resolution":{"observed_at":"2026-08-11T15:09:50.684310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:09:50.689646Z","title":"Does learning require memorization? a short tale about a long tail","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.689646Z"},"links":{"citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:192dbc90fe321178596a9992cce2b7f5fc7fba7c7afd76a64bbbd6a546999d7e","observation_id":"19dffadc-0e1b-4dd5-aedb-ca58187dda87","resolution":{"observed_at":"2026-08-11T15:09:50.689646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18362","last_updated":"2023-10-24T14:25:53Z","snapshot_observed_at":"2026-08-16T14:49:19.852945Z","submitted_at":"2023-10-24T14:25:53Z","title":"SoK: Memorization in General-Purpose Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.18362","snapshot_observed_at":"2026-08-11T15:09:50.694182Z","title":"Sok: Memorization in general-purpose large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.694182Z"},"links":{"cited_paper":"/paper/2310.18362","citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:2ca77304f0817b177776fb7bc229886c74db91cb2ce15f67eaa9d7d7110a3465","observation_id":"456f9785-a1c2-4e51-8637-679c58bb63e2","resolution":{"observed_at":"2026-08-11T15:09:50.694182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19482","last_updated":"2025-03-20T15:35:56Z","snapshot_observed_at":"2026-08-16T13:05:59.107109Z","submitted_at":"2024-10-25T11:37:04Z","title":"Measuring memorization in language models via probabilistic extraction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19482","snapshot_observed_at":"2026-08-11T15:09:50.701547Z","title":"Measuring memorization through probabilistic discoverable extraction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.701547Z"},"links":{"cited_paper":"/paper/2410.19482","citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:0dc161b37424d1d93bd6711e1b52f15799410b107ebe955311760d3f4522339a","observation_id":"bbfb7957-6198-4f91-ba7f-3126fd49aa71","resolution":{"observed_at":"2026-08-11T15:09:50.701547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12628","last_updated":"2022-10-20T05:30:43Z","snapshot_observed_at":"2026-08-17T14:09:03.289442Z","submitted_at":"2022-05-25T10:08:45Z","title":"Are Large Pre-Trained Language Models Leaking Your Personal Information?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12628","snapshot_observed_at":"2026-08-11T15:09:50.706508Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.706508Z"},"links":{"cited_paper":"/paper/2205.12628","citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:0ec86a28a3bf2d3f67251c96d7c66fa97302151c17259751afe948fc35825eda","observation_id":"103ef7f8-7d4b-4583-a9cd-b654093eaf37","resolution":{"observed_at":"2026-08-11T15:09:50.706508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:09:50.712445Z","title":"Preventing generation of verbatim memorization in language models gives a false sense of privacy","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.712445Z"},"links":{"citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:480c61c089b843269d32de1a08303af920b65e4401346e3c7ea1f596de7f6e9d","observation_id":"04733d41-86de-4b99-83d2-eb337497d844","resolution":{"observed_at":"2026-08-11T15:09:50.712445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04801","last_updated":"2025-02-09T19:38:18Z","snapshot_observed_at":"2026-08-18T17:46:13.412024Z","submitted_at":"2024-03-05T19:32:01Z","title":"Alpaca against Vicuna: Using LLMs to Uncover Memorization of LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04801","snapshot_observed_at":"2026-08-11T15:09:50.716503Z","title":"M., Mahmoud, O., Mireshghallah, N., Kim, H., Tsvetkov, Y., Choi, Y., Saad, S., and Rana, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.716503Z"},"links":{"cited_paper":"/paper/2403.04801","citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:25124c79fed22a08aafad7b9e2d87eef1bb38ee25acc269169cedd11ca7f3166","observation_id":"9d85a289-75ec-4ecb-9055-5b354f654f5f","resolution":{"observed_at":"2026-08-11T15:09:50.716503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:09:51.087269Z","title":null,"venue":null,"work_id":"70cb65b3-ef57-4e27-b54e-a2cdd3ae8980","year":2024},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.722385Z"},"links":{"citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:590f86c9b17e889719970c2f2fb8eeac1711052b0466f39a95d2b5d10c7db964","observation_id":"a29ef7da-327e-4151-bb9a-c1f292fdf8d5","resolution":{"observed_at":"2026-08-11T15:09:51.093483Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15720","last_updated":"2024-06-22T03:32:09Z","snapshot_observed_at":"2026-08-16T13:40:34.788208Z","submitted_at":"2024-06-22T03:32:09Z","title":"Scaling Laws for Fact Memorization of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15720","snapshot_observed_at":"2026-08-11T15:09:50.727089Z","title":"Scaling laws for fact memorization of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.727089Z"},"links":{"cited_paper":"/paper/2406.15720","citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:dea953b6541c0ce003ac8734d4e67c6b71958f5c2f6195596ed0c9647b6a4f19","observation_id":"0da8c77d-9d8c-405f-ab62-41e40e91e513","resolution":{"observed_at":"2026-08-11T15:09:50.727089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:09:51.056848Z","title":"Analyzing leakage of personally identifiable information in language models","venue":null,"work_id":"e6dd942d-1594-4dd0-aa80-40f04c74f99e","year":2023},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.733185Z"},"links":{"citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:a542a9de1b75813b2825277bf21d78eaf21527039e2838c074a5c19e45d05714","observation_id":"7f3b5048-3899-46ac-bfcc-fd7a77b5d186","resolution":{"observed_at":"2026-08-11T15:09:51.065094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:09:51.039056Z","title":"C., Sedghi, H., Lipton, Z","venue":null,"work_id":"87701679-a4e7-475f-9e27-160f8b0ea962","year":2023},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.738595Z"},"links":{"citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:d7b9c329a65d6309debb8395f874cff3120c708eb38ea28d035b66656f8af467","observation_id":"d35d609d-137e-4575-82f1-95b787f2ed40","resolution":{"observed_at":"2026-08-11T15:09:51.044310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:09:51.021386Z","title":"C hat G P T","venue":null,"work_id":"2efe604e-fbac-4b1d-9aa0-2711596041df","year":2022},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.742966Z"},"links":{"citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:b6eb3f56186d20ae75eddc33bb101e63ba2230b7997f4c71ce2b6b8ae327f5e6","observation_id":"3ef6e066-11d8-48ff-94d2-1890b7955b73","resolution":{"observed_at":"2026-08-11T15:09:51.027772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:09:51.002185Z","title":"Detecting pretraining data from large language models","venue":null,"work_id":"97942ef3-a9f0-4c6e-96d6-235d0ef1737f","year":2023},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.747433Z"},"links":{"citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:218e000183e31ed61c23d8973b9d9de13b605fc7acae03d46011ceb2a906555c","observation_id":"9d60a4bf-05fb-47e4-9039-eed3acce549e","resolution":{"observed_at":"2026-08-11T15:09:51.007931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:09:50.752799Z","title":"Memorization without overfitting: Analyzing the training dynamics of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.752799Z"},"links":{"citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:5001e0aff53589cfb0416e46b998b8961a5936ccc76bf8a3d32d5923f6d4231d","observation_id":"64e3bba5-c49b-4144-a6f6-2dc091111e60","resolution":{"observed_at":"2026-08-11T15:09:50.752799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:09:50.969974Z","title":"Bag of tricks for training data extraction from language models","venue":null,"work_id":"23137c91-e65b-4c7c-9aa1-1deb4505b7cd","year":2023},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.758964Z"},"links":{"citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:0658d354fcf6a8daa7323c1390c2570330428b150f5afd47bbf64991baa2a188","observation_id":"ef3377b9-db58-44d2-8090-b6094a1efae0","resolution":{"observed_at":"2026-08-11T15:09:50.975569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:09:50.765890Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.765890Z"},"links":{"citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:7c9e7ca5d18667c35c6aacf105916934d8dbef26d6078a900386c2b535591e8c","observation_id":"d474e47b-2bdc-41a0-b8f7-cd1b399c2275","resolution":{"observed_at":"2026-08-11T15:09:50.765890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:09:50.771333Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.771333Z"},"links":{"citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:6f5a0f97adf5f632a2fcaba0bc4781dc1aede546e88f5b635580146d38b5247c","observation_id":"659ac40c-5641-4597-8fa8-cc197dce25ec","resolution":{"observed_at":"2026-08-11T15:09:50.771333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:09:50.920704Z","title":"More recently, duan2024membership,shi2023detecting also explore such Membership Inference Attacks on LLMs","venue":null,"work_id":"80768b68-0c77-4ec4-85eb-76ab94ca5e6f","year":null},"citing_paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T15:09:50.778525Z"},"links":{"citing_paper":"/paper/2412.11302"},"observation_digest":"sha256:ffe6e4c760ca9af1d64cba3331bd4b5a65227e99636fec0c7a9b5496fb497f9f","observation_id":"ab1648f5-ca93-4ec8-9a80-05d74c8ea4bd","resolution":{"observed_at":"2026-08-11T15:09:50.931597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.11302","last_updated":"2025-04-16T04:30:56Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-18T17:46:50.068809Z","submitted_at":"2024-12-15T20:27:45Z","title":"Sequence-Level Leakage Risk of Training Data in Large Language Models"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":10},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 4 inbound Pith citation observations for arXiv:2412.11302."}