{"as_of":"2026-08-21T08:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5b3996e3c744b3945a50cf307f01a3a9ea0ddece50d48b3651e45cdd93cee0f5","coverage":[{"denominator":3,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T09:05:33.034464Z","state":"measured"},{"denominator":4,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":4,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T00:38:41.160077Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.29495","last_updated":"2026-05-28T07:19:47Z","snapshot_observed_at":"2026-08-18T08:07:16.041112Z","submitted_at":"2026-05-28T07:19:47Z","title":"On-Policy Replay for Continual Supervised Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.29495","snapshot_observed_at":"2026-08-01T00:38:41.160077Z","title":"On-policy replay for continual supervised fine-tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26173","last_updated":"2026-07-28T18:29:45Z","snapshot_observed_at":"2026-08-12T12:20:37.312304Z","submitted_at":"2026-07-28T18:29:45Z","title":"Shared SFT Lessons Across Alignment, Model Organisms, and Toy Models","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-01T00:38:41.160077Z"},"links":{"cited_paper":"/paper/2605.29495","citing_paper":"/paper/2607.26173"},"observation_digest":"sha256:0ff0c95a3de0a4d7dda5b06d40194e565d1919fd5e44c513c0bc11aa2b556dcf","observation_id":"d06789e2-a277-43d9-bd79-ce7a9ea4405e","resolution":{"observed_at":"2026-08-01T00:38:41.160077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.29495/citation-record","integrity":"/paper/2605.29495/integrity","json":"/paper/2605.29495/citation-record.json","paper":"/paper/2605.29495"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.04676","last_updated":"2025-08-06T17:42:22Z","snapshot_observed_at":"2026-08-18T12:41:40.603859Z","submitted_at":"2025-08-06T17:42:22Z","title":"GeRe: Towards Efficient Anti-Forgetting in Continual Learning of LLM via General Samples Replay","version":1},"cited_work":{"arxiv_id":"2508.04676","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.04676","snapshot_observed_at":"2026-06-29T09:13:16.301066Z","title":"Gere: Towards efficient anti-forgetting in continual learning of llm via general samples replay","venue":null,"work_id":"602d5bcc-4b5f-4ed8-8c07-6958e2e45842","year":2023},"citing_paper":{"arxiv_id":"2605.29495","last_updated":"2026-05-28T07:19:47Z","snapshot_observed_at":"2026-08-18T08:07:16.041112Z","submitted_at":"2026-05-28T07:19:47Z","title":"On-Policy Replay for Continual Supervised Fine-Tuning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T09:05:33.034464Z"},"links":{"cited_paper":"/paper/2508.04676","citing_paper":"/paper/2605.29495"},"observation_digest":"sha256:254b0c084e9a102614e5312e3eab5e4c541327cf4df04db0a61b07d989a8055c","observation_id":"fb37a9e9-4231-4a3e-9305-faa28754926a","resolution":{"observed_at":"2026-06-29T09:13:16.302628Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.18734","last_updated":"2026-03-20T15:40:19Z","snapshot_observed_at":"2026-08-13T14:47:47.249767Z","submitted_at":"2026-01-26T17:56:50Z","title":"Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models","version":3},"cited_work":{"arxiv_id":"2601.18734","doi":"10.18653/v1/2025.emnlp-main.125.https://aclanthology.org/2025.emnlp-main.125/","metadata_source":"pith","pith_arxiv_id":"2601.18734","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models","venue":"cs.LG","work_id":"bae00e84-9b0d-433d-a066-20b951f0b4d0","year":2026},"citing_paper":{"arxiv_id":"2605.29495","last_updated":"2026-05-28T07:19:47Z","snapshot_observed_at":"2026-08-18T08:07:16.041112Z","submitted_at":"2026-05-28T07:19:47Z","title":"On-Policy Replay for Continual Supervised Fine-Tuning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T09:05:33.034464Z"},"links":{"cited_paper":"/paper/2601.18734","citing_paper":"/paper/2605.29495"},"observation_digest":"sha256:049eb9d0bdee1cf4dac82ba9babd70b5ef9390887b53e6c45f8c9cd781f291dc","observation_id":"2a250fa2-bb35-4187-92c4-f137bbba3b37","resolution":{"observed_at":"2026-06-29T09:13:16.299992Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.08926","last_updated":"2026-04-10T03:42:16Z","snapshot_observed_at":"2026-08-18T08:06:29.001809Z","submitted_at":"2026-04-10T03:42:16Z","title":"Bridging SFT and RL: Dynamic Policy Optimization for Robust Reasoning","version":1},"cited_work":{"arxiv_id":"2604.08926","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.08926","snapshot_observed_at":"2026-06-29T09:13:16.303854Z","title":"Bridging SFT and RL: Dynamic Policy Optimization for Robust Reasoning","venue":"cs.LG","work_id":"57c162fb-974e-4b5e-b141-e2f2fe456b40","year":2026},"citing_paper":{"arxiv_id":"2605.29495","last_updated":"2026-05-28T07:19:47Z","snapshot_observed_at":"2026-08-18T08:07:16.041112Z","submitted_at":"2026-05-28T07:19:47Z","title":"On-Policy Replay for Continual Supervised Fine-Tuning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T09:05:33.034464Z"},"links":{"cited_paper":"/paper/2604.08926","citing_paper":"/paper/2605.29495"},"observation_digest":"sha256:9930dee27128dc8b946eb894ea4d0a4eff1c0154cccd4a23ce7cb158dab818e4","observation_id":"c741a415-7a1b-4a47-a9f7-aeb649339e89","resolution":{"observed_at":"2026-06-29T09:13:16.305324Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.29495","last_updated":"2026-05-28T07:19:47Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-18T08:07:16.041112Z","submitted_at":"2026-05-28T07:19:47Z","title":"On-Policy Replay for Continual Supervised Fine-Tuning"},"reference_resolution":{"displayed":3,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":3},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 3 of 3 outbound references and 1 inbound Pith citation observation for arXiv:2605.29495."}