{"as_of":"2026-08-15T03:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3ab533a90e9e1acdb4e5ac1ef40ddfc8179e885d89a5cb04d0eef61cd7ba689d","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":3,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":3,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T10:51:30.546134Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T16:29:56.845413Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2512.06547","last_updated":"2026-08-12T17:58:33Z","snapshot_observed_at":"2026-08-15T03:12:59.779901Z","submitted_at":"2025-12-06T19:37:39Z","title":"A-3PO: Accelerating Asynchronous LLM Training with Staleness-aware Proximal Policy Approximation","version":4},"cited_work":{"arxiv_id":"2512.06547","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.06547","snapshot_observed_at":"2026-08-13T02:25:25.422196Z","title":"A-3po: Accelerating asynchronous llm training with staleness-aware proximal policy approximation","venue":null,"work_id":"12f20c93-c3e0-4e31-9b1a-e81c52887246","year":2025},"citing_paper":{"arxiv_id":"2605.12070","last_updated":"2026-05-12T12:57:55Z","snapshot_observed_at":"2026-08-15T01:18:34.156920Z","submitted_at":"2026-05-12T12:57:55Z","title":"Missing Old Logits in Asynchronous Agentic RL: Semantic Mismatch and Repair Methods for Off-Policy Correction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T05:57:49.286939Z"},"links":{"cited_paper":"/paper/2512.06547","citing_paper":"/paper/2605.12070"},"observation_digest":"sha256:4667c18ff450fc06b7cdc6a15fee6d041cb337d07cee8ef346318ecef184eaa4","observation_id":"9934be26-66fd-4b6b-9e49-ce933009aa73","resolution":{"observed_at":"2026-08-13T02:25:25.422196Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.06547","last_updated":"2026-08-12T17:58:33Z","snapshot_observed_at":"2026-08-15T03:12:59.779901Z","submitted_at":"2025-12-06T19:37:39Z","title":"A-3PO: Accelerating Asynchronous LLM Training with Staleness-aware Proximal Policy Approximation","version":4},"cited_work":{"arxiv_id":"2512.06547","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.06547","snapshot_observed_at":"2026-08-13T02:25:25.422196Z","title":"A-3po: Accelerating asynchronous llm training with staleness-aware proximal policy approximation","venue":null,"work_id":"12f20c93-c3e0-4e31-9b1a-e81c52887246","year":2025},"citing_paper":{"arxiv_id":"2606.03382","last_updated":"2026-06-04T22:09:00Z","snapshot_observed_at":"2026-08-02T02:33:38.414458Z","submitted_at":"2026-06-02T09:26:26Z","title":"Local Guidance, Global Impact: Gaussian-Reshaped Trust Region Unlocks Behavior Transitions","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-06-28T10:51:30.546134Z"},"links":{"cited_paper":"/paper/2512.06547","citing_paper":"/paper/2606.03382"},"observation_digest":"sha256:f08825d1815b99e58980c7c6f97503b54756cba3fc8b2ab1a33cd4b1f9cf979c","observation_id":"b78cdfb6-79ef-4c0c-b475-12f9093d13fd","resolution":{"observed_at":"2026-08-13T02:25:25.422196Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.06547","last_updated":"2026-08-12T17:58:33Z","snapshot_observed_at":"2026-08-15T03:12:59.779901Z","submitted_at":"2025-12-06T19:37:39Z","title":"A-3PO: Accelerating Asynchronous LLM Training with Staleness-aware Proximal Policy Approximation","version":4},"cited_work":{"arxiv_id":"2512.06547","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.06547","snapshot_observed_at":"2026-08-13T02:25:25.422196Z","title":"A-3po: Accelerating asynchronous llm training with staleness-aware proximal policy approximation","venue":null,"work_id":"12f20c93-c3e0-4e31-9b1a-e81c52887246","year":2025},"citing_paper":{"arxiv_id":"2606.24143","last_updated":"2026-06-23T04:50:49Z","snapshot_observed_at":"2026-08-11T22:35:09.036491Z","submitted_at":"2026-06-23T04:50:49Z","title":"AsyncOPD: How Stale Can On-Policy Distillation Be?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T00:40:57.112748Z"},"links":{"cited_paper":"/paper/2512.06547","citing_paper":"/paper/2606.24143"},"observation_digest":"sha256:4cbf695336b32f875863174b239557cde7732098c9df12617cbc6415861322bb","observation_id":"4704fa64-7b1d-416a-899c-2fcc9b767ff1","resolution":{"observed_at":"2026-08-13T02:25:25.422196Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2512.06547/citation-record","integrity":"/paper/2512.06547/integrity","json":"/paper/2512.06547/citation-record.json","paper":"/paper/2512.06547"},"outbound":[],"paper":{"arxiv_id":"2512.06547","last_updated":"2026-08-12T17:58:33Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T03:12:59.779901Z","submitted_at":"2025-12-06T19:37:39Z","title":"A-3PO: Accelerating Asynchronous LLM Training with Staleness-aware Proximal Policy Approximation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 3 inbound Pith citation observations for arXiv:2512.06547."}