{"as_of":"2026-08-08T06:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fe95a26f0fa8c2134ad5c27f5b82ef656e9ecd6754496880acea5da3b8195322","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:54:36.744382Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.14777/citation-record","integrity":"/paper/2507.14777/integrity","json":"/paper/2507.14777/citation-record.json","paper":"/paper/2507.14777"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:29.868443Z","title":"On the dangers of stochastic parrots: Can language models be too big? In Proceedings of the 2021 ACM conference on fairness, accountability, and transparency, pages 610–623, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:29.868443Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:572263d8e0748406dcff14d29a0dc35a604e4ba595ca59d01c350f7aeaf98a68","observation_id":"4e847438-46c7-4ec9-b561-c9d0a9f332fa","resolution":{"observed_at":"2026-08-06T15:54:29.868443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12712","last_updated":"2023-04-13T20:41:31Z","snapshot_observed_at":"2026-08-03T04:49:15.195814Z","submitted_at":"2023-03-22T16:51:28Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12712","snapshot_observed_at":"2026-08-06T15:54:29.950605Z","title":"Sparks of artificial general intelligence: Early experiments with gpt-4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:29.950605Z"},"links":{"cited_paper":"/paper/2303.12712","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:dd136df6eb0388f2d3d7b2c972f6b0c914af7aaa43f11a896ab2a121467970f3","observation_id":"10243b96-78c1-46f2-b8c4-112f06a23218","resolution":{"observed_at":"2026-08-06T15:54:29.950605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15146","last_updated":"2024-11-11T19:47:16Z","snapshot_observed_at":"2026-07-06T18:04:26.177088Z","submitted_at":"2024-04-23T15:49:37Z","title":"Rethinking LLM Memorization through the Lens of Adversarial Compression","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15146","snapshot_observed_at":"2026-08-06T15:54:30.048277Z","title":"Rethinking llm memorization through the lens of adversarial compression.arXiv preprint arXiv:2404.15146, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.048277Z"},"links":{"cited_paper":"/paper/2404.15146","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:923264b9541321d7d3aa0303b1f27ce3ae2afd53c446dfcffb57ad0a6aed756d","observation_id":"81a74fa8-00f0-4709-8da7-0f67c5704d13","resolution":{"observed_at":"2026-08-06T15:54:30.048277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.491353Z","title":"Emergent and predictable memorization in large language models","venue":null,"work_id":"823028eb-7a07-44d5-a3f5-35bc4a66abaa","year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.162709Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:778b6cbf9edaeb64529676c4971d69bdc8a1ed78727e17f6253bcead9afe61fd","observation_id":"5456ca5e-b454-429c-958a-5147a3c56c84","resolution":{"observed_at":"2026-08-06T15:54:38.496777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.474636Z","title":"Deduplicating training data mitigates privacy risks in language models","venue":null,"work_id":"8b947627-f64a-442b-9519-f8b1fd1197ea","year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.240434Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:c436ad4486ec964493bba66d465e0f268bd071f0c5d640614eaeffc0329f4a99","observation_id":"fe800e97-3f51-4140-b8bb-4f18b53d222c","resolution":{"observed_at":"2026-08-06T15:54:38.479388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:30.318127Z","title":"Extracting training data from large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.318127Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:4231f5409a080e51e7dbf6622220d2b7e1a3e55d5501b61aa568e2501835bf80","observation_id":"647b9d7d-7770-4f58-9aef-0d71318d8997","resolution":{"observed_at":"2026-08-06T15:54:30.318127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.447192Z","title":"The secret sharer: Evaluating and testing unintended memorization in neural networks","venue":null,"work_id":"9ba470ae-96fd-4c87-94bf-b65256c54c6a","year":2019},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.432387Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:6c321fccc40c912f94af7082308a796b05bf72885356cf0677fc2a2a55a9e20a","observation_id":"c42f2838-495d-4ac6-b947-c5cdc13c5de7","resolution":{"observed_at":"2026-08-06T15:54:38.453047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.431172Z","title":"Memorization without overfitting: Analyzing the training dynamics of large language models","venue":null,"work_id":"9aa57630-bf2f-4465-bd6c-29ce48f79a6e","year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.549998Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:c152dd713b3c5170fb6b74b7739ba483efc086c31de95f8cb3221934eab9d14a","observation_id":"3e800049-4c5e-4569-9ed7-9452abd987da","resolution":{"observed_at":"2026-08-06T15:54:38.436190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.414659Z","title":"An empirical analysis of memorization in fine-tuned autoregressive language models","venue":null,"work_id":"582f4d68-7d85-44ef-bc5c-a9515508eff7","year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.629170Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:719bc9565525bf03a5477978d9ec75e21ed2fec264f17eb046c8d4e6726d8580","observation_id":"f2b82d42-a3f3-4285-b1e5-b3b8f2625d49","resolution":{"observed_at":"2026-08-06T15:54:38.419749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17546","last_updated":"2023-09-11T16:58:48Z","snapshot_observed_at":"2026-08-04T04:34:05.607113Z","submitted_at":"2022-10-31T17:57:55Z","title":"Preventing Verbatim Memorization in Language Models Gives a False Sense of Privacy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17546","snapshot_observed_at":"2026-08-06T15:54:30.675295Z","title":"Preventing verbatim memorization in language models gives a false sense of privacy","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.675295Z"},"links":{"cited_paper":"/paper/2210.17546","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:3bd417899fe421a5d9d81e5494a70d47d99ccde955ac16db2d01fd4df7d38535","observation_id":"53d68b14-1b20-4665-878c-e98da5c22880","resolution":{"observed_at":"2026-08-06T15:54:30.675295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.394993Z","title":"Near-duplicate sequence search at scale for large language model memorization evaluation","venue":null,"work_id":"acc24366-1b21-4cf3-8385-6ca923839969","year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.681438Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:670be18d084f6ab0f77b5c1b4175339febcb0de22e287a30128ecf2efe44d0b1","observation_id":"a196b3dd-61dd-48e2-b376-0b93f1741b64","resolution":{"observed_at":"2026-08-06T15:54:38.401276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.379190Z","title":"Uncovering latent memories: Assessing data leakage and memorization patterns in large language models","venue":null,"work_id":"9d41addf-c19e-463a-8b2b-1fa80450f12c","year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.746169Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:40b74432d0d06a69ada3c10c50d130e6f9385a1285a4590d3e7bb1b4b7377481","observation_id":"b22ae51b-c1b1-4919-8f4a-a540e501330e","resolution":{"observed_at":"2026-08-06T15:54:38.384012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.363108Z","title":"Quantifying and analyzing entity-level memorization in large language models","venue":null,"work_id":"2327e5c1-e94d-449f-97f8-7d6f01c28346","year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.833461Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:7f7dc86d842371dc65bd568bab7ef4e094c05bc3d1ba063c57a5bc9edf6d69cd","observation_id":"39e45161-ffa6-47f0-bd98-2bc6062bf507","resolution":{"observed_at":"2026-08-06T15:54:38.368188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.12938","last_updated":"2023-10-13T22:16:41Z","snapshot_observed_at":"2026-08-04T07:54:45.222448Z","submitted_at":"2021-12-24T04:20:57Z","title":"Counterfactual Memorization in Neural Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.12938","snapshot_observed_at":"2026-08-06T15:54:30.920640Z","title":"Counterfactual memorization in neural language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.920640Z"},"links":{"cited_paper":"/paper/2112.12938","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:0b4f81374a4c98197fb164232a0d57ac115cbf61ad369bb805ba7694cf9cb3f9","observation_id":"d1e79c42-62da-413e-b5b3-759e0e1d3272","resolution":{"observed_at":"2026-08-06T15:54:30.920640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.343735Z","title":"On memorization in probabilistic deep generative models","venue":null,"work_id":"5d85c6ec-6662-4715-a181-9f8978e8542a","year":2021},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:30.989824Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:bb3d2b373f39cce5a40d866cb7f3de2f4c166401557027777082337873956d8a","observation_id":"6174912d-47d5-4e35-a835-28e563d3894a","resolution":{"observed_at":"2026-08-06T15:54:38.350123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.06499","last_updated":"2022-03-24T19:29:45Z","snapshot_observed_at":"2026-08-05T18:30:13.997811Z","submitted_at":"2021-07-14T06:06:52Z","title":"Deduplicating Training Data Makes Language Models Better","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.06499","snapshot_observed_at":"2026-08-06T15:54:31.117800Z","title":"Deduplicating training data makes language models better","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:31.117800Z"},"links":{"cited_paper":"/paper/2107.06499","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:50f480bae5c0338119a200f691c7070a3ce4cee2f5ba68e2a18a626ee518493a","observation_id":"11513c1e-3f72-419a-840e-84e621194ec0","resolution":{"observed_at":"2026-08-06T15:54:31.117800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:31.212886Z","title":"‘improving ratings’: audit in the british university system","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:31.212886Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:8a472f393717124be7309e2304923a5c7e071fe04b61920535b7f980a0b6cb94","observation_id":"d3555407-feca-46e4-b7b7-73d3f2eaf761","resolution":{"observed_at":"2026-08-06T15:54:31.212886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.07646","last_updated":"2023-03-06T06:28:18Z","snapshot_observed_at":"2026-08-03T19:51:05.627063Z","submitted_at":"2022-02-15T18:48:31Z","title":"Quantifying Memorization Across Neural Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.07646","snapshot_observed_at":"2026-08-06T15:54:31.324658Z","title":"Quantifying memorization across neural language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:31.324658Z"},"links":{"cited_paper":"/paper/2202.07646","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:bf0703363d71e4f8f2fa8ce6cd28c1faa62af5c56660d7c553d964c1f66814bc","observation_id":"4408f1bf-837b-4ea9-9b9f-696b4f9a79fd","resolution":{"observed_at":"2026-08-06T15:54:31.324658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04289","last_updated":"2025-01-12T15:43:54Z","snapshot_observed_at":"2026-07-06T18:26:42.010940Z","submitted_at":"2024-06-06T17:34:24Z","title":"What Languages are Easy to Language-Model? A Perspective from Learning Probabilistic Regular Languages","version":5},"cited_work":{"arxiv_id":"2406.04289","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.04289","snapshot_observed_at":"2026-08-06T15:54:37.958204Z","title":"What Languages are Easy to Language-Model? A Perspective from Learning Probabilistic Regular Languages","venue":"cs.CL","work_id":"1b092d9c-4abe-425e-8e3f-648f52c0e98e","year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:31.457040Z"},"links":{"cited_paper":"/paper/2406.04289","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:5604e5287d430d9202a75dbf85978934890256a845a98eadbc2251a8ffdbce80","observation_id":"4263cebb-4060-4b65-896b-2de9b439bc5a","resolution":{"observed_at":"2026-08-06T15:54:37.963182Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12973","last_updated":"2024-01-30T18:59:34Z","snapshot_observed_at":"2026-07-06T17:19:31.847730Z","submitted_at":"2024-01-23T18:59:21Z","title":"In-Context Language Learning: Architectures and Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12973","snapshot_observed_at":"2026-08-06T15:54:31.579512Z","title":"In-context language learning: Arhitectures and algorithms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:31.579512Z"},"links":{"cited_paper":"/paper/2401.12973","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:7da4768cddd074ede9a4123d6fa8184b38821ae1b8805dd92a35811f515f0c3c","observation_id":"a94ead0e-82a4-49da-9c2c-6319821ec3fb","resolution":{"observed_at":"2026-08-06T15:54:31.579512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.14840","last_updated":"2023-10-23T12:03:01Z","snapshot_observed_at":"2026-08-03T01:55:13.775166Z","submitted_at":"2023-10-23T12:03:01Z","title":"Transparency at the Source: Evaluating and Interpreting Language Models With Access to the True Distribution","version":1},"cited_work":{"arxiv_id":"2310.14840","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.14840","snapshot_observed_at":"2026-08-06T15:54:37.919994Z","title":"Transparency at the Source: Evaluating and Interpreting Language Models With Access to the True Distribution","venue":"cs.CL","work_id":"af4bef28-9782-4815-8a5e-0407737da851","year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:31.696400Z"},"links":{"cited_paper":"/paper/2310.14840","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:c2580cce1c85cad841d901e24b1c6dc9d0ea4cb43731365949077d8fa7ad9903","observation_id":"17974dc2-0ddd-4234-8d37-f89ed29fc3e0","resolution":{"observed_at":"2026-08-06T15:54:37.925415Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13060","last_updated":"2023-10-29T17:14:06Z","snapshot_observed_at":"2026-07-06T15:19:57.802336Z","submitted_at":"2023-04-25T18:00:08Z","title":"Injecting structural hints: Using language models to study inductive biases in language learning","version":2},"cited_work":{"arxiv_id":"2304.13060","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.13060","snapshot_observed_at":"2026-08-06T15:54:37.899246Z","title":"Injecting structural hints: Using language models to study inductive biases in language learning","venue":"cs.CL","work_id":"4e83e133-6277-4e8a-83ab-cb4c5822c997","year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:31.855458Z"},"links":{"cited_paper":"/paper/2304.13060","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:4ea85ac1930e24adc0ce1b06e7c1efb12a3bd87cccfa13cecba2a9dbb45a3411","observation_id":"07d6192d-096c-4969-b7e7-f8594e0c1f01","resolution":{"observed_at":"2026-08-06T15:54:37.904123Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.01044","last_updated":"2021-06-02T09:34:32Z","snapshot_observed_at":"2026-08-02T14:15:42.519406Z","submitted_at":"2021-06-02T09:34:32Z","title":"Examining the Inductive Bias of Neural Language Models with Artificial Languages","version":1},"cited_work":{"arxiv_id":"2106.01044","doi":null,"metadata_source":"pith","pith_arxiv_id":"2106.01044","snapshot_observed_at":"2026-08-06T15:54:37.876666Z","title":"Examining the Inductive Bias of Neural Language Models with Artificial Languages","venue":"cs.CL","work_id":"d171f949-44ae-4b9f-927d-27e6e8b6ee0e","year":2021},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:32.025451Z"},"links":{"cited_paper":"/paper/2106.01044","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:bd739c713b453d1b019ab999cb04f91e66e2cf191e9e58aeecdd6a1fb509cd20","observation_id":"f0087c7c-2edd-41c6-a011-ae34753e25e8","resolution":{"observed_at":"2026-08-06T15:54:37.881979Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.327986Z","title":"Towards more natural artificial languages","venue":null,"work_id":"75f35aa6-d253-4c44-8c38-b41b875cf87b","year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:32.170446Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:d26176223f2a50a47dbfd3e2602d89384e5da1ce79a752e6f60ef19bbfe4914e","observation_id":"86210bac-8088-4515-a4b9-4768ee3d6db2","resolution":{"observed_at":"2026-08-06T15:54:38.332904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13673","last_updated":"2025-05-19T11:12:27Z","snapshot_observed_at":"2026-07-06T15:31:05.250637Z","submitted_at":"2023-05-23T04:28:16Z","title":"Physics of Language Models: Part 1, Learning Hierarchical Language Structures","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13673","snapshot_observed_at":"2026-08-06T15:54:32.373894Z","title":"Physics of language models: Part 1, learning hierarchical language structures","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:32.373894Z"},"links":{"cited_paper":"/paper/2305.13673","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:a56f532d83d6a5fa27faa78a14080a0967c9eeed1d932dbdba012428136f4a64","observation_id":"d368c22f-7575-4753-99eb-25ca9ba6cef6","resolution":{"observed_at":"2026-08-06T15:54:32.373894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.03796","last_updated":"2023-05-05T18:54:40Z","snapshot_observed_at":"2026-07-06T15:23:56.550794Z","submitted_at":"2023-05-05T18:54:40Z","title":"Transformer Working Memory Enables Regular Language Reasoning and Natural Language Length Extrapolation","version":1},"cited_work":{"arxiv_id":"2305.03796","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.03796","snapshot_observed_at":"2026-08-06T15:54:37.833815Z","title":"Transformer Working Memory Enables Regular Language Reasoning and Natural Language Length Extrapolation","venue":"cs.CL","work_id":"7b830679-68fd-4050-967d-45831e90c642","year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:32.521304Z"},"links":{"cited_paper":"/paper/2305.03796","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:96138ce67b806c8c5d16696962faf5213a84cd1420ede5a1806f43e4cd154a03","observation_id":"99d76e3b-b84c-4262-b639-909255249b6a","resolution":{"observed_at":"2026-08-06T15:54:37.839608Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01288","last_updated":"2022-11-03T22:44:21Z","snapshot_observed_at":"2026-07-06T14:13:39.478174Z","submitted_at":"2022-11-02T17:10:07Z","title":"Characterizing Intrinsic Compositionality in Transformers with Tree Projections","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01288","snapshot_observed_at":"2026-08-06T15:54:32.722899Z","title":"Char- acterizing intrinsic compositionality in transformers with tree projections","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:32.722899Z"},"links":{"cited_paper":"/paper/2211.01288","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:1f3b6abc49ad7ece1015b1f0c5661c6ea6935dbe6e4c02baa4734d0c9a03e82c","observation_id":"79339cde-805c-424f-b061-74c468863a24","resolution":{"observed_at":"2026-08-06T15:54:32.722899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.10749","last_updated":"2023-05-02T14:16:15Z","snapshot_observed_at":"2026-08-05T14:55:09.743440Z","submitted_at":"2022-10-19T17:45:48Z","title":"Transformers Learn Shortcuts to Automata","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.10749","snapshot_observed_at":"2026-08-06T15:54:32.921274Z","title":"Transformers learn shortcuts to automata","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:32.921274Z"},"links":{"cited_paper":"/paper/2210.10749","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:de74f2f2fffbab657ad7c7805c3a50c77e884b9baa83bc0ddddef586e4936ba2","observation_id":"3f495db6-6e73-4c31-8b3b-5c85d0f97a6c","resolution":{"observed_at":"2026-08-06T15:54:32.921274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.311580Z","title":"Learning bounded context- free-grammar via lstm and the transformer: difference and the explanations","venue":null,"work_id":"136de89b-2edc-48a0-9f10-a6bd53b3d7c3","year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:33.105814Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:10b598e968fdce8e93a357f9ba850bf2a4cad68fa8bf69ee00f1e204167242b5","observation_id":"9f00af93-6c21-416c-a0da-afb227a6f1cc","resolution":{"observed_at":"2026-08-06T15:54:38.316903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.11264","last_updated":"2020-10-08T12:55:37Z","snapshot_observed_at":"2026-07-06T09:58:11.932794Z","submitted_at":"2020-09-23T17:21:33Z","title":"On the Ability and Limitations of Transformers to Recognize Formal Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.11264","snapshot_observed_at":"2026-08-06T15:54:33.333452Z","title":"On the ability and limitations of trans- formers to recognize formal languages","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:33.333452Z"},"links":{"cited_paper":"/paper/2009.11264","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:20a261d5dc35713558fb544e160942c06f576bc300ed64b73486d363fd2121ef","observation_id":"0ab13602-b305-4969-a10b-b80fbd4cc797","resolution":{"observed_at":"2026-08-06T15:54:33.333452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.295511Z","title":"Formal languages and the nlp black box","venue":null,"work_id":"48946270-1fef-4abb-b137-d20258589550","year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:33.541358Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:32db375ae6aeffaabd7570b2c3e6164b6b9aa596e3f9ff7a5e6e9568ebc42887","observation_id":"c43bed4f-b29c-4fae-acb5-5f3a0a9b8193","resolution":{"observed_at":"2026-08-06T15:54:38.300374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00208","last_updated":"2024-09-04T11:48:04Z","snapshot_observed_at":"2026-08-04T23:39:05.034721Z","submitted_at":"2023-11-01T00:38:26Z","title":"What Formal Languages Can Transformers Express? A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00208","snapshot_observed_at":"2026-08-06T15:54:33.692930Z","title":"Transformers as recognizers of formal languages: A survey on expressivity","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:33.692930Z"},"links":{"cited_paper":"/paper/2311.00208","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:9fa5b3b1685b7e7893401057abecf719a9dd37ad46527f4fce3e7e9827c650c5","observation_id":"870460b6-eafa-40f6-bb2e-45df5a873f85","resolution":{"observed_at":"2026-08-06T15:54:33.692930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.277331Z","title":"Theoretical limitations of self-attention in neural sequence models","venue":null,"work_id":"738352e8-49ab-4e59-a577-318bb35026de","year":2020},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:33.803922Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:826efa77deab81860e5a37c23bc42a2cc6558b1c5621bd5284f53959cadbb840","observation_id":"e8a4df78-5dcd-45a6-b35d-7990b3e7e3f0","resolution":{"observed_at":"2026-08-06T15:54:38.282902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-07-06T13:28:01.742166Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-06T15:54:33.911739Z","title":"Neural networks and the chomsky hierarchy","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:33.911739Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:59d63f05729f537654e49e4cc6dfe297196ff7b88bc9914c17572843400174b0","observation_id":"329e5830-fad8-4f8b-95a5-1353a9b0c8d9","resolution":{"observed_at":"2026-08-06T15:54:33.911739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09963","last_updated":"2024-05-27T17:01:29Z","snapshot_observed_at":"2026-08-07T22:03:59.611479Z","submitted_at":"2024-02-15T14:17:51Z","title":"Why are Sensitive Functions Hard for Transformers?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09963","snapshot_observed_at":"2026-08-06T15:54:33.958427Z","title":"Why are sensitive functions hard for transformers? arXiv preprint arXiv:2402.09963, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:33.958427Z"},"links":{"cited_paper":"/paper/2402.09963","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:c0a95fd77a080ab28dd1664b481daf5f6fc4a929be54652c4315f8285a7c385c","observation_id":"9213f9c7-cd0f-4d46-b13c-3943507de087","resolution":{"observed_at":"2026-08-06T15:54:33.958427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03743","last_updated":"2020-02-25T18:30:29Z","snapshot_observed_at":"2026-07-06T06:44:01.658334Z","submitted_at":"2018-06-10T23:24:33Z","title":"Are All Languages Equally Hard to Language-Model?","version":2},"cited_work":{"arxiv_id":"1806.03743","doi":null,"metadata_source":"pith","pith_arxiv_id":"1806.03743","snapshot_observed_at":"2026-08-06T15:54:37.673219Z","title":"Are All Languages Equally Hard to Language-Model?","venue":"cs.CL","work_id":"29538ff9-126a-4228-aad7-e98532a7302a","year":2018},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.015203Z"},"links":{"cited_paper":"/paper/1806.03743","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:d96055fb957b6c76de61e2ab52a3a177478f2707983d89dd2e7cff0aac8a3bce","observation_id":"bc5a3e7d-ed8b-4ef9-86ec-917c159be891","resolution":{"observed_at":"2026-08-06T15:54:37.693810Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04726","last_updated":"2020-02-25T18:38:57Z","snapshot_observed_at":"2026-07-30T16:12:07.215876Z","submitted_at":"2019-06-11T17:56:08Z","title":"What Kind of Language Is Hard to Language-Model?","version":2},"cited_work":{"arxiv_id":"1906.04726","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.04726","snapshot_observed_at":"2026-08-06T15:54:37.578425Z","title":"What Kind of Language Is Hard to Language-Model?","venue":"cs.CL","work_id":"414bcdbf-ea06-408d-8950-383688e9ecd5","year":2019},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.058378Z"},"links":{"cited_paper":"/paper/1906.04726","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:c734d89cb0e38040851e99134d7f8eadf07769ec1f4a2c429a8e89e5c652882e","observation_id":"7fdd7e02-d358-4864-836e-3a2b841d7c58","resolution":{"observed_at":"2026-08-06T15:54:37.649165Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:34.171170Z","title":"Elements of information theory","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.171170Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:959a657dac781bc03201af853ce0d4cb39969c631c2ee55264103b44650885d5","observation_id":"41ffa587-0f56-4161-a127-a8b0f4d75f6f","resolution":{"observed_at":"2026-08-06T15:54:34.171170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.250160Z","title":"Carrasco","venue":null,"work_id":"597e7a62-2209-4f9a-a71d-13ede20ec823","year":1997},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.223047Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:7dc64262622370c6cd3cecfb688d4297ad6b77765d8bf81a4b0b27ce05afb9bf","observation_id":"5dfaad75-b384-4dc6-be3d-d8418ffc8870","resolution":{"observed_at":"2026-08-06T15:54:38.254760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-06T15:54:34.297362Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.297362Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:b105ef65e15d99740fee14e2e8d04d6b9e96d0c2017fef7a7f8481dd69178001","observation_id":"cbd6df96-5182-4123-aabb-901eb2c3b721","resolution":{"observed_at":"2026-08-06T15:54:34.297362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T15:54:34.345999Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.345999Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:62594a5620b14d9e6345dae521f2d8996ab853daaa4d3c0c1afbe9194249d3e1","observation_id":"f8cce4bb-71c2-4cb8-b840-785d03471654","resolution":{"observed_at":"2026-08-06T15:54:34.345999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-06T15:54:34.446211Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.446211Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:795ca9da2b995132a2792765b7cd75edf93cb7a3ef2698b700541b6daba75afc","observation_id":"346f76fc-3499-4750-b9e2-9ab0bc7acdcf","resolution":{"observed_at":"2026-08-06T15:54:34.446211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-06T15:54:34.504173Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.504173Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:082584be435beef88fddbec32357964c0b9a57d01bff08d09889bf7f643ebb92","observation_id":"daa972fd-78db-41f7-8bcc-dadc69d22098","resolution":{"observed_at":"2026-08-06T15:54:34.504173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:34.601309Z","title":"Pythia: A suite for analyzing large language models across training and scaling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.601309Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:4427aec21e3188d9b27a67ade998ce61eec9801b6f9ef89c92aed8eb4a3e9fcd","observation_id":"c4262e12-d378-4476-8e61-94abfe5631ae","resolution":{"observed_at":"2026-08-06T15:54:34.601309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-06T15:54:34.665366Z","title":"Opt: Open pre-trained transformer language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.665366Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:61b130e96f5cf72168a482edb84b190f8434c58bbe8af27ab039fa734b8f93ae","observation_id":"9c0ba11a-aa4a-4c67-bc06-8e68c860c08a","resolution":{"observed_at":"2026-08-06T15:54:34.665366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.223161Z","title":"Cross-entropy loss functions: Theoretical analysis and applications","venue":null,"work_id":"3cbeae59-9af7-41de-898d-498a55f6314a","year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.750218Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:107b5185fc74c2267068f9f4d824b52206a87147bb401edffa71cd40efbb23c4","observation_id":"0a28b1d8-9c80-492b-bb59-515a99b38e6a","resolution":{"observed_at":"2026-08-06T15:54:38.227935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12628","last_updated":"2022-10-20T05:30:43Z","snapshot_observed_at":"2026-08-08T01:32:04.235019Z","submitted_at":"2022-05-25T10:08:45Z","title":"Are Large Pre-Trained Language Models Leaking Your Personal Information?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12628","snapshot_observed_at":"2026-08-06T15:54:34.827067Z","title":"Are large pre-trained language models leaking your personal information? arXiv preprint arXiv:2205.12628, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.827067Z"},"links":{"cited_paper":"/paper/2205.12628","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:cec1c4fd131b221cc6d50fb4385dfe050487af3067e5647da2b3b9fd5fc3aa40","observation_id":"62724fd1-90b0-468a-a306-45fb21bddb27","resolution":{"observed_at":"2026-08-06T15:54:34.827067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.206741Z","title":"Propile: Probing privacy leakage in large language models","venue":null,"work_id":"267d33c8-81fe-42c1-a8f0-f3d8ef95f326","year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.930061Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:54658173bfc6f0f75a65fd70e4eb24892e3d007319e9b1d965431a5ee2dcb71d","observation_id":"30b7b062-b258-45a1-b23a-d1b272136903","resolution":{"observed_at":"2026-08-06T15:54:38.211572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.00099","last_updated":"2023-05-09T14:08:17Z","snapshot_observed_at":"2026-07-06T13:26:38.135401Z","submitted_at":"2022-06-30T20:48:26Z","title":"Measuring Forgetting of Memorized Training Examples","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.00099","snapshot_observed_at":"2026-08-06T15:54:34.984512Z","title":"Measuring forgetting of memorized training examples","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:34.984512Z"},"links":{"cited_paper":"/paper/2207.00099","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:fb64be40e8917c56ab263bb7588f36fd2b253281ce844c71ebc02856e08113f8","observation_id":"f0f6c9ba-01fa-4a9c-a6bc-d728ebb78d84","resolution":{"observed_at":"2026-08-06T15:54:34.984512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-06T15:54:35.095617Z","title":"The pile: An 800gb dataset of diverse text for language modeling","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:35.095617Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:e02d5075da1a33c618d988d086646a122cfd0c28b262ec423b53097a6e44ac4a","observation_id":"b416c6cb-322e-404b-9aae-9898d5f34fcc","resolution":{"observed_at":"2026-08-06T15:54:35.095617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00838","last_updated":"2024-06-07T21:59:52Z","snapshot_observed_at":"2026-07-06T17:23:51.547578Z","submitted_at":"2024-02-01T18:28:55Z","title":"OLMo: Accelerating the Science of Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00838","snapshot_observed_at":"2026-08-06T15:54:35.178701Z","title":"Olmo: Accelerating the science of language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:35.178701Z"},"links":{"cited_paper":"/paper/2402.00838","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:6dac980c2258554b7f438966f5982b00172fe35fd4f6c14264072cce4e14f908","observation_id":"861368a3-81a4-4d2c-a9a5-d0f57aaeaa1f","resolution":{"observed_at":"2026-08-06T15:54:35.178701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:35.258472Z","title":"Revisiting privacy, utility, and efficiency trade-offs when fine-tuning large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:35.258472Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:b492e3f9374ee428f8bf613b0a54e9f4dad3a702555b443722255973c6105f53","observation_id":"d91affa0-d007-4b44-8e4a-4394694fd270","resolution":{"observed_at":"2026-08-06T15:54:35.258472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.190365Z","title":"Foundation models and fair use","venue":null,"work_id":"b61f4602-b19f-4546-86b5-1eb9a736863e","year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:35.374698Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:f64e5ba4313e1f6bcf2b7340552a5d2e3cd493c7ba24c0e41f3dd079767262ef","observation_id":"4117af86-efc2-4d5f-a641-246f6e8e037f","resolution":{"observed_at":"2026-08-06T15:54:38.196150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.172502Z","title":"Llms and memorization: On quality and specificity of copyright compliance","venue":null,"work_id":"e771aec8-c2eb-4aa7-b78b-e2611dc6e75c","year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:35.453875Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:2a257702e877f3d73aeca2c2d2f8c429158e89be7e09287d3f6b76ac78446154","observation_id":"2116a35d-121e-439c-8bc7-75b00babaaef","resolution":{"observed_at":"2026-08-06T15:54:38.178090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06370","last_updated":"2024-12-09T10:44:47Z","snapshot_observed_at":"2026-07-06T20:03:47.277630Z","submitted_at":"2024-12-09T10:44:47Z","title":"Exploring Memorization and Copyright Violation in Frontier LLMs: A Study of the New York Times v. OpenAI 2023 Lawsuit","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06370","snapshot_observed_at":"2026-08-06T15:54:35.545591Z","title":"Exploring memorization and copyright violation in frontier llms: A study of the new york times v","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:35.545591Z"},"links":{"cited_paper":"/paper/2412.06370","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:4d59044c73939829924c1e5a6a7b201a1a08a20022d3e8e0c844a1a75d5fc31f","observation_id":"a9f22345-5b8b-491a-8d38-152e2a9084e0","resolution":{"observed_at":"2026-08-06T15:54:35.545591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:35.602191Z","title":"Undesirable memorization in large language models: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:35.602191Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:30065b8ce96a0b0b8dd3d5b4dc769754e724a9b102ba02ad51a65399f99ffd45","observation_id":"33b4e3da-f702-44a1-9179-8442b4769fa6","resolution":{"observed_at":"2026-08-06T15:54:35.602191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11715","last_updated":"2024-10-25T10:40:25Z","snapshot_observed_at":"2026-08-04T19:49:55.600191Z","submitted_at":"2024-06-17T16:33:35Z","title":"Measuring memorization in RLHF for code completion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11715","snapshot_observed_at":"2026-08-06T15:54:35.707199Z","title":"Measuring memorization in rlhf for code completion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:35.707199Z"},"links":{"cited_paper":"/paper/2406.11715","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:3cd1a327eefdc2a5d96cceb10f19aa9080e5a430997f79330356841647190e38","observation_id":"b2f237b6-4786-4fcf-88f1-7f812050fe23","resolution":{"observed_at":"2026-08-06T15:54:35.707199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.155941Z","title":"What neural networks memorize and why: Discovering the long tail via influence estimation","venue":null,"work_id":"82fd0177-8127-4fb3-aaca-33a7fd35ecbe","year":2020},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:35.776038Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:dd0f4d87f36aeeadab68da51090da8a902597da16762de9c866c20f13a5d1ea6","observation_id":"e9363736-34a8-4604-a218-127feab40bb3","resolution":{"observed_at":"2026-08-06T15:54:38.161158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03588","last_updated":"2023-02-13T12:26:13Z","snapshot_observed_at":"2026-08-07T10:14:52.877852Z","submitted_at":"2022-10-07T14:45:31Z","title":"Understanding Transformer Memorization Recall Through Idioms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03588","snapshot_observed_at":"2026-08-06T15:54:35.853655Z","title":"Under- standing transformer memorization recall through idioms","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:35.853655Z"},"links":{"cited_paper":"/paper/2210.03588","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:e30bc7442a1c5a0763e3c057f022a48424a4972385f88baa21aa2dfa230f802d","observation_id":"6885741a-8c18-4186-bead-c65f7f6f44a1","resolution":{"observed_at":"2026-08-06T15:54:35.853655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14985","last_updated":"2025-03-02T03:27:58Z","snapshot_observed_at":"2026-07-06T18:49:33.987133Z","submitted_at":"2024-07-20T21:24:40Z","title":"Generalization v.s. Memorization: Tracing Language Models' Capabilities Back to Pretraining Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14985","snapshot_observed_at":"2026-08-06T15:54:35.942487Z","title":"Generalization vs memorization: Tracing language models’ capabilities back to pretraining data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:35.942487Z"},"links":{"cited_paper":"/paper/2407.14985","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:6d489c1c89ae32297e18058246d356a35f648474cb984ed34e403d1708b3771f","observation_id":"32107197-b353-4d20-97d1-32a1e1ba110a","resolution":{"observed_at":"2026-08-06T15:54:35.942487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18497","last_updated":"2025-07-09T15:14:46Z","snapshot_observed_at":"2026-07-06T20:12:49.966786Z","submitted_at":"2024-12-24T15:28:56Z","title":"Neuron-Level Differentiation of Memorization and Generalization in Large Language Models","version":2},"cited_work":{"arxiv_id":"2412.18497","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.18497","snapshot_observed_at":"2026-08-06T15:54:37.025421Z","title":"Neuron-Level Differentiation of Memorization and Generalization in Large Language Models","venue":"cs.CL","work_id":"aaa48314-682b-4000-91cb-dd63fcdf63ea","year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:35.978341Z"},"links":{"cited_paper":"/paper/2412.18497","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:929468adbea5b7e77b7792420863997ef6790977c61a509cf7f052a7695ac3a3","observation_id":"1fc6a6d9-70d9-4f89-b81f-79d9629410bb","resolution":{"observed_at":"2026-08-06T15:54:37.096373Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:36.050260Z","title":"Mem- orize or generalize? evaluating llm code generation with evolved questions","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:36.050260Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:e87d0571e5fdd9c5ec2cae2dd76d2acb2a62cca0f42a49b3dd7ab229230439fa","observation_id":"084e2ae6-1562-473d-a9f9-7fd738f0bfc4","resolution":{"observed_at":"2026-08-06T15:54:36.050260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.137804Z","title":"Rethinking memorization in llms: On learning by rote vs","venue":null,"work_id":"ac2d802c-d94d-467e-ae46-5baf6649b30f","year":null},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:36.175005Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:a055101d0494be37ec62c43bdda7f046d7457989ddcbd6042f9c68e2f5bbe9ba","observation_id":"dbabadd5-3e65-4cd6-9838-41c6169aa49d","resolution":{"observed_at":"2026-08-06T15:54:38.142821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15938","last_updated":"2024-05-31T17:49:03Z","snapshot_observed_at":"2026-08-03T17:29:17.531819Z","submitted_at":"2024-02-24T23:54:41Z","title":"Generalization or Memorization: Data Contamination and Trustworthy Evaluation for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15938","snapshot_observed_at":"2026-08-06T15:54:36.269021Z","title":"Generalization or memorization: Data contamination and trustworthy evaluation for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:36.269021Z"},"links":{"cited_paper":"/paper/2402.15938","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:c5d4794d51ac2e3d90d134a12090e67796480f9a5f0c7c514f470ef43fdd6e72","observation_id":"9b23b898-db20-48ec-b167-74c318f44a07","resolution":{"observed_at":"2026-08-06T15:54:36.269021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.120677Z","title":"How much do language models copy from their training data? evaluating linguistic novelty in text generation using raven","venue":null,"work_id":"2430d72c-11d9-4b9d-b849-abc195f1d414","year":2023},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:36.427188Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:f1aea614d813e3cc2120e56be0f7c33497c4a6cd8b88d108eface70901ca7cdc","observation_id":"ca744455-129d-400e-a611-bc8905256784","resolution":{"observed_at":"2026-08-06T15:54:38.126751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.106108Z","title":"Probabilistic context-free grammars (pcfgs)","venue":null,"work_id":"19eb7bf9-6c12-4caf-84df-3bee78f84a52","year":2013},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:36.513639Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:3d6d8e2997cce553009c5745251e8fbd51ca0e54bead575fb7e4cec3e58579c9","observation_id":"7f1046a2-ca4f-4b21-bf5c-0da81377d50a","resolution":{"observed_at":"2026-08-06T15:54:38.110569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.090194Z","title":"Three models for the description of language.IRE Transactions on information theory, 2(3):113–124, 1956","venue":null,"work_id":"76776c0d-a32c-4517-a500-b16e3c931c68","year":1956},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:36.647912Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:dc77c5e7207fc6aa1a6489e5e30b710a42592c8912b13b535835704e749429b3","observation_id":"3a810597-8292-4537-8cb0-b2c58caeb65a","resolution":{"observed_at":"2026-08-06T15:54:38.094870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:54:38.075266Z","title":"start\" or","venue":null,"work_id":"c5ac99dd-c4c4-48db-b677-d8ed08b02a50","year":2014},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:36.744382Z"},"links":{"citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:221ce9293af26c5c56857e3654aaac2fa9ad3c6bdaf17b60d7013173aca6eaff","observation_id":"57a0bd6c-e27e-4b69-bcd7-040a214e93b2","resolution":{"observed_at":"2026-08-06T15:54:38.079569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":8,"verified_fuzzy":24},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 0 inbound Pith citation observations for arXiv:2507.14777."}