{"as_of":"2026-08-08T09:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3157b025843f9df97c2ece1a1d10b0b12fc989febb7f5129858a658dc73e6985","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:48:48.773375Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T14:05:29.753472Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.01720","last_updated":"2025-02-06T06:42:17Z","snapshot_observed_at":"2026-07-06T19:26:22.646942Z","submitted_at":"2024-10-02T16:32:05Z","title":"Towards a Theoretical Understanding of Synthetic Data in LLM Post-Training: A Reverse-Bottleneck Perspective","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01720","snapshot_observed_at":"2026-08-07T12:48:48.773375Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23540","last_updated":"2025-05-29T15:20:44Z","snapshot_observed_at":"2026-08-07T14:34:56.721276Z","submitted_at":"2025-05-29T15:20:44Z","title":"Probability-Consistent Preference Optimization for Enhanced LLM Reasoning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T12:48:48.773375Z"},"links":{"cited_paper":"/paper/2410.01720","citing_paper":"/paper/2505.23540"},"observation_digest":"sha256:f2736fd8c58ed9cb9bb86bcd60c81f20e599f7bc360de91ec30dbf30e90a5858","observation_id":"9ed398c0-88ae-4c62-87ff-d30bc9adbbb4","resolution":{"observed_at":"2026-08-07T12:48:48.773375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01720","last_updated":"2025-02-06T06:42:17Z","snapshot_observed_at":"2026-07-06T19:26:22.646942Z","submitted_at":"2024-10-02T16:32:05Z","title":"Towards a Theoretical Understanding of Synthetic Data in LLM Post-Training: A Reverse-Bottleneck Perspective","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01720","snapshot_observed_at":"2026-08-07T11:19:45.079626Z","title":"Towards a theoretical understanding of synthetic data in llm post- training: A reverse-bottleneck perspective.arXiv preprint arXiv:2410.01720, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02867","last_updated":"2025-06-04T15:00:58Z","snapshot_observed_at":"2026-08-08T01:10:04.863511Z","submitted_at":"2025-06-03T13:31:10Z","title":"Demystifying Reasoning Dynamics with Mutual Information: Thinking Tokens are Information Peaks in LLM Reasoning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:19:45.079626Z"},"links":{"cited_paper":"/paper/2410.01720","citing_paper":"/paper/2506.02867"},"observation_digest":"sha256:f845b9ff08c050e696f500db6c7a9d8ebf282b224607bfb7dbca664c514f26b8","observation_id":"cd2a50e4-1942-4863-bdef-577236a27e25","resolution":{"observed_at":"2026-08-07T11:19:45.079626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01720","last_updated":"2025-02-06T06:42:17Z","snapshot_observed_at":"2026-07-06T19:26:22.646942Z","submitted_at":"2024-10-02T16:32:05Z","title":"Towards a Theoretical Understanding of Synthetic Data in LLM Post-Training: A Reverse-Bottleneck Perspective","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01720","snapshot_observed_at":"2026-08-05T15:38:42.741219Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19689","last_updated":"2025-08-27T08:52:47Z","snapshot_observed_at":"2026-08-07T07:48:25.655053Z","submitted_at":"2025-08-27T08:52:47Z","title":"Building Task Bots with Self-learning for Enhanced Adaptability, Extensibility, and Factuality","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T15:38:42.741219Z"},"links":{"cited_paper":"/paper/2410.01720","citing_paper":"/paper/2508.19689"},"observation_digest":"sha256:98bc034bc14cec36de38a7d2d2b3fe46f54736128b3e7ffffe3171d26aef19b9","observation_id":"384fa7d8-fc95-43ad-8c44-5106192b7f23","resolution":{"observed_at":"2026-08-05T15:38:42.741219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01720","last_updated":"2025-02-06T06:42:17Z","snapshot_observed_at":"2026-07-06T19:26:22.646942Z","submitted_at":"2024-10-02T16:32:05Z","title":"Towards a Theoretical Understanding of Synthetic Data in LLM Post-Training: A Reverse-Bottleneck Perspective","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01720","snapshot_observed_at":"2026-08-05T10:31:37.775535Z","title":"Towards a theoretical understanding of synthetic data in llm post-training: A reverse-bottleneck perspective","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04027","last_updated":"2026-06-09T07:28:31Z","snapshot_observed_at":"2026-08-05T10:31:32.575543Z","submitted_at":"2025-09-04T09:02:16Z","title":"Why Does Reasoning Length Converge? Unveiling the Underfitting-Overfitting Trade-off in Chain-of-Thought","version":4},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T10:31:37.775535Z"},"links":{"cited_paper":"/paper/2410.01720","citing_paper":"/paper/2509.04027"},"observation_digest":"sha256:f786575a7c63eae0134343727ba8be36348e20f84c3838b859261b8f5bde242c","observation_id":"8b0b2129-bb5a-4ea7-92e5-788a2ffe8717","resolution":{"observed_at":"2026-08-05T10:31:37.775535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01720","last_updated":"2025-02-06T06:42:17Z","snapshot_observed_at":"2026-07-06T19:26:22.646942Z","submitted_at":"2024-10-02T16:32:05Z","title":"Towards a Theoretical Understanding of Synthetic Data in LLM Post-Training: A Reverse-Bottleneck Perspective","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01720","snapshot_observed_at":"2026-08-04T17:31:38.391114Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10886","last_updated":"2025-09-13T16:33:56Z","snapshot_observed_at":"2026-08-06T23:51:24.789255Z","submitted_at":"2025-09-13T16:33:56Z","title":"CultureSynth: A Hierarchical Taxonomy-Guided and Retrieval-Augmented Framework for Cultural Question-Answer Synthesis","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T17:31:38.391114Z"},"links":{"cited_paper":"/paper/2410.01720","citing_paper":"/paper/2509.10886"},"observation_digest":"sha256:f778eb95fc2a5139cb613a39ffa3c019e351065998d5cff5438fe82444b952a4","observation_id":"d15d8db5-5f2f-439d-978d-4e9263fa54ae","resolution":{"observed_at":"2026-08-04T17:31:38.391114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01720","last_updated":"2025-02-06T06:42:17Z","snapshot_observed_at":"2026-07-06T19:26:22.646942Z","submitted_at":"2024-10-02T16:32:05Z","title":"Towards a Theoretical Understanding of Synthetic Data in LLM Post-Training: A Reverse-Bottleneck Perspective","version":3},"cited_work":{"arxiv_id":"2410.01720","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.01720","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gan and Y","venue":null,"work_id":"530ae016-02c3-49e2-a48b-c22b7de2bc3b","year":null},"citing_paper":{"arxiv_id":"2604.26965","last_updated":"2026-04-14T16:06:14Z","snapshot_observed_at":"2026-07-06T23:12:29.385105Z","submitted_at":"2026-04-14T16:06:14Z","title":"The Impact of AI-Generated Text on the Internet","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T14:01:29.175202Z"},"links":{"cited_paper":"/paper/2410.01720","citing_paper":"/paper/2604.26965"},"observation_digest":"sha256:159c518e8ba1317b61bb2ee20c3b70911610d1cef70271a6e22ba5fca229fc3d","observation_id":"cc02d816-f8ec-4e81-bade-ddab450dfe58","resolution":{"observed_at":"2026-05-10T14:05:29.756369Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2410.01720/citation-record","integrity":"/paper/2410.01720/integrity","json":"/paper/2410.01720/citation-record.json","paper":"/paper/2410.01720"},"outbound":[],"paper":{"arxiv_id":"2410.01720","last_updated":"2025-02-06T06:42:17Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T19:26:22.646942Z","submitted_at":"2024-10-02T16:32:05Z","title":"Towards a Theoretical Understanding of Synthetic Data in LLM Post-Training: A Reverse-Bottleneck Perspective"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2410.01720."}