{"as_of":"2026-08-10T14:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a784093c39b4f4fab0c7176ba7ebc98d626f734c258020b2ba5a728585e2ac29","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T20:08:32.920085Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T12:56:57.463531Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.14985","last_updated":"2025-03-02T03:27:58Z","snapshot_observed_at":"2026-08-09T23:18:26.350617Z","submitted_at":"2024-07-20T21:24:40Z","title":"Generalization v.s. Memorization: Tracing Language Models' Capabilities Back to Pretraining Data","version":5},"cited_work":{"arxiv_id":"2407.14985","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.14985","snapshot_observed_at":"2026-07-02T12:56:57.463531Z","title":"Generalization vs memorization: Tracing language models’ capabilities back to pretraining data","venue":null,"work_id":"a5ef05dd-4996-45cc-bfe4-7314859b4618","year":2025},"citing_paper":{"arxiv_id":"2412.20760","last_updated":"2025-03-19T19:08:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-30T07:09:25Z","title":"Attributing Culture-Conditioned Generations to Pretraining Corpora","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-23T07:05:52.610830Z"},"links":{"cited_paper":"/paper/2407.14985","citing_paper":"/paper/2412.20760"},"observation_digest":"sha256:8c1490aaf9f24437e5e52fe9c9dfe37a81c88c6a2292bea3c96a99750daa0f59","observation_id":"568eba03-a1d3-49e6-833c-25752633c68f","resolution":{"observed_at":"2026-05-23T07:07:41.670904Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14985","last_updated":"2025-03-02T03:27:58Z","snapshot_observed_at":"2026-08-09T23:18:26.350617Z","submitted_at":"2024-07-20T21:24:40Z","title":"Generalization v.s. Memorization: Tracing Language Models' Capabilities Back to Pretraining Data","version":5},"cited_work":{"arxiv_id":"2407.14985","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.14985","snapshot_observed_at":"2026-07-02T12:56:57.463531Z","title":"Generalization vs memorization: Tracing language models’ capabilities back to pretraining data","venue":null,"work_id":"a5ef05dd-4996-45cc-bfe4-7314859b4618","year":2025},"citing_paper":{"arxiv_id":"2501.17161","last_updated":"2025-05-26T17:16:45Z","snapshot_observed_at":"2026-08-09T18:26:12.869738Z","submitted_at":"2025-01-28T18:59:44Z","title":"SFT Memorizes, RL Generalizes: A Comparative Study of Foundation Model Post-training","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-12T21:31:30.202477Z"},"links":{"cited_paper":"/paper/2407.14985","citing_paper":"/paper/2501.17161"},"observation_digest":"sha256:946031fe33af6889d64bfad2e3f71e9d6cc5b5da7ed39a57dec2e4ca1a3b9f00","observation_id":"38733b99-0b44-4409-9a65-7ecd40589275","resolution":{"observed_at":"2026-05-12T21:31:30.245269Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14985","last_updated":"2025-03-02T03:27:58Z","snapshot_observed_at":"2026-08-09T23:18:26.350617Z","submitted_at":"2024-07-20T21:24:40Z","title":"Generalization v.s. Memorization: Tracing Language Models' Capabilities Back to Pretraining Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14985","snapshot_observed_at":"2026-08-08T20:08:32.920085Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05148","last_updated":"2025-02-07T18:26:01Z","snapshot_observed_at":"2026-08-09T10:35:01.115491Z","submitted_at":"2025-02-07T18:26:01Z","title":"An Annotated Reading of 'The Singer of Tales' in the LLM Era","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T20:08:32.920085Z"},"links":{"cited_paper":"/paper/2407.14985","citing_paper":"/paper/2502.05148"},"observation_digest":"sha256:8ce18f805671f26a1571dd8300554478bedc01c734f117930438a9df82f19b8a","observation_id":"3fff36b1-6b09-4f6a-bd91-16d978ae4a92","resolution":{"observed_at":"2026-08-08T20:08:32.920085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14985","last_updated":"2025-03-02T03:27:58Z","snapshot_observed_at":"2026-08-09T23:18:26.350617Z","submitted_at":"2024-07-20T21:24:40Z","title":"Generalization v.s. Memorization: Tracing Language Models' Capabilities Back to Pretraining Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14985","snapshot_observed_at":"2026-08-07T14:19:04.095763Z","title":"Generalization vs memorization: Tracing language models’ capabilities back to pretraining data","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19406","last_updated":"2025-05-26T01:42:38Z","snapshot_observed_at":"2026-08-07T20:32:06.174757Z","submitted_at":"2025-05-26T01:42:38Z","title":"Unveiling the Compositional Ability Gap in Vision-Language Reasoning Model","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:19:04.095763Z"},"links":{"cited_paper":"/paper/2407.14985","citing_paper":"/paper/2505.19406"},"observation_digest":"sha256:68a28d2f562194319b18ad81acaef93b6108977aed1957df7cf4ca1f06f713ff","observation_id":"2c5e2e8c-d1f1-45c9-808b-d94d2edc3773","resolution":{"observed_at":"2026-08-07T14:19:04.095763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14985","last_updated":"2025-03-02T03:27:58Z","snapshot_observed_at":"2026-08-09T23:18:26.350617Z","submitted_at":"2024-07-20T21:24:40Z","title":"Generalization v.s. Memorization: Tracing Language Models' Capabilities Back to Pretraining Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14985","snapshot_observed_at":"2026-08-06T22:53:58.081705Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20481","last_updated":"2025-06-25T14:25:11Z","snapshot_observed_at":"2026-08-09T14:01:12.768167Z","submitted_at":"2025-06-25T14:25:11Z","title":"Counterfactual Influence as a Distributional Quantity","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T22:53:58.081705Z"},"links":{"cited_paper":"/paper/2407.14985","citing_paper":"/paper/2506.20481"},"observation_digest":"sha256:b37477810bcc4ccd4f93ad7140b65fa5808c903056a74ce788725eba35ca6cc1","observation_id":"71656722-bb95-43e0-b6f6-202da549b4f6","resolution":{"observed_at":"2026-08-06T22:53:58.081705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14985","last_updated":"2025-03-02T03:27:58Z","snapshot_observed_at":"2026-08-09T23:18:26.350617Z","submitted_at":"2024-07-20T21:24:40Z","title":"Generalization v.s. Memorization: Tracing Language Models' Capabilities Back to Pretraining Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14985","snapshot_observed_at":"2026-08-06T18:51:06.739410Z","title":"Generalization v.s","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07186","last_updated":"2025-07-12T10:00:59Z","snapshot_observed_at":"2026-08-08T20:46:11.979357Z","submitted_at":"2025-07-09T18:01:14Z","title":"Planted in Pretraining, Swayed by Finetuning: A Case Study on the Origins of Cognitive Biases in LLMs","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T18:51:06.739410Z"},"links":{"cited_paper":"/paper/2407.14985","citing_paper":"/paper/2507.07186"},"observation_digest":"sha256:2d42af9853d5d4a8a2ec0b3b793d559cea37dfdb84e8cd6a75140ce0a8851094","observation_id":"20315f6b-4426-4237-b172-e0699b58a691","resolution":{"observed_at":"2026-08-06T18:51:06.739410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14985","last_updated":"2025-03-02T03:27:58Z","snapshot_observed_at":"2026-08-09T23:18:26.350617Z","submitted_at":"2024-07-20T21:24:40Z","title":"Generalization v.s. Memorization: Tracing Language Models' Capabilities Back to Pretraining Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14985","snapshot_observed_at":"2026-08-06T16:10:28.285063Z","title":"Generalization vs memorization: Tracing language models’ capabilities back to pretraining data,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14393","last_updated":"2025-07-18T22:46:27Z","snapshot_observed_at":"2026-08-09T18:14:32.463154Z","submitted_at":"2025-07-18T22:46:27Z","title":"Adaptive Multi-Agent Reasoning via Automated Workflow Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:10:28.285063Z"},"links":{"cited_paper":"/paper/2407.14985","citing_paper":"/paper/2507.14393"},"observation_digest":"sha256:a34c00680ef3ddeba424c34f947f6d881953dbfefbaa3a6512af7a679b3c92d7","observation_id":"df5a10f9-4434-46e4-9ae7-06f36e703b51","resolution":{"observed_at":"2026-08-06T16:10:28.285063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14985","last_updated":"2025-03-02T03:27:58Z","snapshot_observed_at":"2026-08-09T23:18:26.350617Z","submitted_at":"2024-07-20T21:24:40Z","title":"Generalization v.s. Memorization: Tracing Language Models' Capabilities Back to Pretraining Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14985","snapshot_observed_at":"2026-08-06T15:54:35.942487Z","title":"Generalization vs memorization: Tracing language models’ capabilities back to pretraining data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:35.942487Z"},"links":{"cited_paper":"/paper/2407.14985","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:1483bf5da2b63f9e85d6f1037fe4e7dbe1f2a210edce532ed02a67b945a0d0c8","observation_id":"32107197-b353-4d20-97d1-32a1e1ba110a","resolution":{"observed_at":"2026-08-06T15:54:35.942487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14985","last_updated":"2025-03-02T03:27:58Z","snapshot_observed_at":"2026-08-09T23:18:26.350617Z","submitted_at":"2024-07-20T21:24:40Z","title":"Generalization v.s. Memorization: Tracing Language Models' Capabilities Back to Pretraining Data","version":5},"cited_work":{"arxiv_id":"2407.14985","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.14985","snapshot_observed_at":"2026-07-02T12:56:57.463531Z","title":"Generalization vs memorization: Tracing language models’ capabilities back to pretraining data","venue":null,"work_id":"a5ef05dd-4996-45cc-bfe4-7314859b4618","year":2025},"citing_paper":{"arxiv_id":"2509.00303","last_updated":"2026-05-19T23:05:35Z","snapshot_observed_at":"2026-07-06T22:20:54.835986Z","submitted_at":"2025-08-30T01:44:36Z","title":"Access Paths for Efficient Ordering with Large Language Models","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-21T22:32:23.352584Z"},"links":{"cited_paper":"/paper/2407.14985","citing_paper":"/paper/2509.00303"},"observation_digest":"sha256:9f40b28e8f41abdd420acaa253ecc552093b971759a1b1afc8f1a6d6bef709c3","observation_id":"112b370f-6934-434e-a8ea-3635e7008483","resolution":{"observed_at":"2026-05-21T22:34:24.173404Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14985","last_updated":"2025-03-02T03:27:58Z","snapshot_observed_at":"2026-08-09T23:18:26.350617Z","submitted_at":"2024-07-20T21:24:40Z","title":"Generalization v.s. Memorization: Tracing Language Models' Capabilities Back to Pretraining Data","version":5},"cited_work":{"arxiv_id":"2407.14985","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.14985","snapshot_observed_at":"2026-07-02T12:56:57.463531Z","title":"Generalization vs memorization: Tracing language models’ capabilities back to pretraining data","venue":null,"work_id":"a5ef05dd-4996-45cc-bfe4-7314859b4618","year":2025},"citing_paper":{"arxiv_id":"2511.00476","last_updated":"2026-02-05T08:39:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-01T10:05:43Z","title":"Remembering Unequally: Global and Disciplinary Bias in LLM Reconstruction of Scholarly Coauthor Lists","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-18T01:48:49.289059Z"},"links":{"cited_paper":"/paper/2407.14985","citing_paper":"/paper/2511.00476"},"observation_digest":"sha256:a125273ba224cf22aa580bfe23bf66da16815b1eafbbf8304ec67a98c2289d7d","observation_id":"0b00a481-05e9-450d-95bc-956650b6dd0e","resolution":{"observed_at":"2026-05-18T01:50:38.090115Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14985","last_updated":"2025-03-02T03:27:58Z","snapshot_observed_at":"2026-08-09T23:18:26.350617Z","submitted_at":"2024-07-20T21:24:40Z","title":"Generalization v.s. Memorization: Tracing Language Models' Capabilities Back to Pretraining Data","version":5},"cited_work":{"arxiv_id":"2407.14985","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.14985","snapshot_observed_at":"2026-07-02T12:56:57.463531Z","title":"Generalization vs memorization: Tracing language models’ capabilities back to pretraining data","venue":null,"work_id":"a5ef05dd-4996-45cc-bfe4-7314859b4618","year":2025},"citing_paper":{"arxiv_id":"2606.06286","last_updated":"2026-06-04T15:25:24Z","snapshot_observed_at":"2026-08-05T07:06:45.210601Z","submitted_at":"2026-06-04T15:25:24Z","title":"LLMs Can Leak Training Data But Do They Want To? A Propensity-Aware Evaluation of Memorization in LLMs","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-28T01:40:53.284131Z"},"links":{"cited_paper":"/paper/2407.14985","citing_paper":"/paper/2606.06286"},"observation_digest":"sha256:7873d1b6abd50dced4e980e4640a8ed6c899b02a77a85f6a407ccb296f3f2328","observation_id":"08fbc6f7-faa8-4e76-9379-ae702127fc99","resolution":{"observed_at":"2026-07-02T12:56:57.465018Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14985","last_updated":"2025-03-02T03:27:58Z","snapshot_observed_at":"2026-08-09T23:18:26.350617Z","submitted_at":"2024-07-20T21:24:40Z","title":"Generalization v.s. Memorization: Tracing Language Models' Capabilities Back to Pretraining Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14985","snapshot_observed_at":"2026-07-11T10:45:46.618668Z","title":"Generalization vs memorization: Tracing language models’ capabilities back to pretraining data.arXiv preprint arXiv:2407.14985,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04969","last_updated":"2026-07-06T11:57:32Z","snapshot_observed_at":"2026-08-07T13:11:14.279030Z","submitted_at":"2026-07-06T11:57:32Z","title":"Train Smarter, Not Longer: Memorization-Guided Data Reuse for Efficient LLM Training","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-11T10:45:46.618668Z"},"links":{"cited_paper":"/paper/2407.14985","citing_paper":"/paper/2607.04969"},"observation_digest":"sha256:119d8018347df8c519e0a1715ba6e2f91dc181619bfe72b36acf280c9654657d","observation_id":"10a4e715-c655-4ca4-aee8-55fcf3ac4764","resolution":{"observed_at":"2026-07-11T10:45:46.618668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2407.14985/citation-record","integrity":"/paper/2407.14985/integrity","json":"/paper/2407.14985/citation-record.json","paper":"/paper/2407.14985"},"outbound":[],"paper":{"arxiv_id":"2407.14985","last_updated":"2025-03-02T03:27:58Z","latest_version":5,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T23:18:26.350617Z","submitted_at":"2024-07-20T21:24:40Z","title":"Generalization v.s. Memorization: Tracing Language Models' Capabilities Back to Pretraining Data"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2407.14985."}