{"as_of":"2026-08-13T05:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2deebfc8769bf06d24f39fd487f6719c13694a676498a0bbcb5c24c2513e2809","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T12:44:26.359895Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T00:29:16.028655Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2012.09092","last_updated":"2020-12-16T17:21:13Z","snapshot_observed_at":"2026-08-13T02:05:24.095708Z","submitted_at":"2020-12-16T17:21:13Z","title":"Sample-Efficient Reinforcement Learning via Counterfactual-Based Data Augmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.09092","snapshot_observed_at":"2026-08-12T12:44:26.359895Z","title":"Sample-efficient reinforcement learning via counterfactual-based data augmentation,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2411.16959","last_updated":"2025-05-20T01:17:09Z","snapshot_observed_at":"2026-08-12T12:39:42.760003Z","submitted_at":"2024-11-25T21:57:15Z","title":"RoCoDA: Counterfactual Data Augmentation for Data-Efficient Robot Learning from Demonstrations","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T12:44:26.359895Z"},"links":{"cited_paper":"/paper/2012.09092","citing_paper":"/paper/2411.16959"},"observation_digest":"sha256:44a075be61b44f43b3238b6e9562492d412cf112b14ec64a0f2b1628ff29b8f6","observation_id":"475e30ba-9c06-4a52-8048-32a76d846e70","resolution":{"observed_at":"2026-08-12T12:44:26.359895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.09092","last_updated":"2020-12-16T17:21:13Z","snapshot_observed_at":"2026-08-13T02:05:24.095708Z","submitted_at":"2020-12-16T17:21:13Z","title":"Sample-Efficient Reinforcement Learning via Counterfactual-Based Data Augmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.09092","snapshot_observed_at":"2026-08-11T15:02:44.174575Z","title":"M.; Zhang, K.; and Schölkopf, B","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.11410","last_updated":"2024-12-20T11:46:05Z","snapshot_observed_at":"2026-08-12T02:50:23.607566Z","submitted_at":"2024-12-16T03:25:28Z","title":"MGDA: Model-based Goal Data Augmentation for Offline Goal-conditioned Weighted Supervised Learning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T15:02:44.174575Z"},"links":{"cited_paper":"/paper/2012.09092","citing_paper":"/paper/2412.11410"},"observation_digest":"sha256:b4c5e6e474f08b22bcb56e2efb9ebdaec8ca20f0c239b8c38466ba811401f47f","observation_id":"6f0d2924-1a90-4a37-a9ef-430c24add48c","resolution":{"observed_at":"2026-08-11T15:02:44.174575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.09092","last_updated":"2020-12-16T17:21:13Z","snapshot_observed_at":"2026-08-13T02:05:24.095708Z","submitted_at":"2020-12-16T17:21:13Z","title":"Sample-Efficient Reinforcement Learning via Counterfactual-Based Data Augmentation","version":1},"cited_work":{"arxiv_id":"2012.09092","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2012.09092","snapshot_observed_at":"2026-07-04T00:29:16.028655Z","title":"arXiv preprint arXiv:2012.09092 , year=","venue":null,"work_id":"0d8fee82-7ddf-4fcf-b314-56341ae46835","year":2012},"citing_paper":{"arxiv_id":"2502.13731","last_updated":"2026-05-22T14:43:44Z","snapshot_observed_at":"2026-08-05T08:00:49.108567Z","submitted_at":"2025-02-19T13:56:20Z","title":"Robust Counterfactual Inference in Markov Decision Processes","version":5},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-25T08:12:09.352914Z"},"links":{"cited_paper":"/paper/2012.09092","citing_paper":"/paper/2502.13731"},"observation_digest":"sha256:25189475014558447f66e948208981acbc5065c26718d77cea85777f3147e928","observation_id":"dcdf0134-dc06-4ec0-bf88-33cacf8c9b05","resolution":{"observed_at":"2026-05-25T08:15:34.051865Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.09092","last_updated":"2020-12-16T17:21:13Z","snapshot_observed_at":"2026-08-13T02:05:24.095708Z","submitted_at":"2020-12-16T17:21:13Z","title":"Sample-Efficient Reinforcement Learning via Counterfactual-Based Data Augmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.09092","snapshot_observed_at":"2026-08-06T21:38:30.899293Z","title":"Sample-Efficient Reinforcement Learning via Counterfactual-Based Data Augmentation,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.23703","last_updated":"2025-06-30T10:26:59Z","snapshot_observed_at":"2026-08-07T04:31:53.714838Z","submitted_at":"2025-06-30T10:26:59Z","title":"A New Perspective On AI Safety Through Control Theory Methodologies","version":1},"reference_index":137,"source":"pdf_text","source_observed_at":"2026-08-06T21:38:30.899293Z"},"links":{"cited_paper":"/paper/2012.09092","citing_paper":"/paper/2506.23703"},"observation_digest":"sha256:70a9f89521eea22fc83273eb6845db767fdf44459c85318b17927433bba1b819","observation_id":"6a00670c-198b-4091-bf9c-add0d4f96c27","resolution":{"observed_at":"2026-08-06T21:38:30.899293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.09092","last_updated":"2020-12-16T17:21:13Z","snapshot_observed_at":"2026-08-13T02:05:24.095708Z","submitted_at":"2020-12-16T17:21:13Z","title":"Sample-Efficient Reinforcement Learning via Counterfactual-Based Data Augmentation","version":1},"cited_work":{"arxiv_id":"2012.09092","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2012.09092","snapshot_observed_at":"2026-07-04T00:29:16.028655Z","title":"arXiv preprint arXiv:2012.09092 , year=","venue":null,"work_id":"0d8fee82-7ddf-4fcf-b314-56341ae46835","year":2012},"citing_paper":{"arxiv_id":"2603.09030","last_updated":"2026-04-06T01:32:12Z","snapshot_observed_at":"2026-07-30T02:16:48.709523Z","submitted_at":"2026-03-09T23:58:07Z","title":"PlayWorld: Learning Robot World Models from Autonomous Play","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-15T14:05:32.112432Z"},"links":{"cited_paper":"/paper/2012.09092","citing_paper":"/paper/2603.09030"},"observation_digest":"sha256:5bf2288e7811b9c5e1de2b8a8c5bf09416ad8f618d40070d329043e9f89f7e25","observation_id":"618b05ec-1f6f-4244-83ba-f32323e17a70","resolution":{"observed_at":"2026-05-15T14:05:54.537514Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.09092","last_updated":"2020-12-16T17:21:13Z","snapshot_observed_at":"2026-08-13T02:05:24.095708Z","submitted_at":"2020-12-16T17:21:13Z","title":"Sample-Efficient Reinforcement Learning via Counterfactual-Based Data Augmentation","version":1},"cited_work":{"arxiv_id":"2012.09092","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2012.09092","snapshot_observed_at":"2026-07-04T00:29:16.028655Z","title":"arXiv preprint arXiv:2012.09092 , year=","venue":null,"work_id":"0d8fee82-7ddf-4fcf-b314-56341ae46835","year":2012},"citing_paper":{"arxiv_id":"2605.16054","last_updated":"2026-05-15T15:21:25Z","snapshot_observed_at":"2026-08-03T10:16:57.496693Z","submitted_at":"2026-05-15T15:21:25Z","title":"Ada-Diffuser: Latent-Aware Adaptive Diffusion for Decision-Making","version":1},"reference_index":234,"source":"arxiv_source","source_observed_at":"2026-05-20T20:54:31.025488Z"},"links":{"cited_paper":"/paper/2012.09092","citing_paper":"/paper/2605.16054"},"observation_digest":"sha256:3d14386c55853bc68d97d1b7656b1e606456b42eb01931df157ccd5d902fec8d","observation_id":"1106de78-35d2-4122-b58f-8cf7720dbee3","resolution":{"observed_at":"2026-05-20T20:59:01.943752Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.09092","last_updated":"2020-12-16T17:21:13Z","snapshot_observed_at":"2026-08-13T02:05:24.095708Z","submitted_at":"2020-12-16T17:21:13Z","title":"Sample-Efficient Reinforcement Learning via Counterfactual-Based Data Augmentation","version":1},"cited_work":{"arxiv_id":"2012.09092","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2012.09092","snapshot_observed_at":"2026-07-04T00:29:16.028655Z","title":"arXiv preprint arXiv:2012.09092 , year=","venue":null,"work_id":"0d8fee82-7ddf-4fcf-b314-56341ae46835","year":2012},"citing_paper":{"arxiv_id":"2606.09115","last_updated":"2026-06-08T07:11:03Z","snapshot_observed_at":"2026-08-04T22:59:05.251199Z","submitted_at":"2026-06-08T07:11:03Z","title":"Counterfactual Transport Flows for Offline Conservative Trajectory Refinement","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-27T17:33:35.857240Z"},"links":{"cited_paper":"/paper/2012.09092","citing_paper":"/paper/2606.09115"},"observation_digest":"sha256:0408f51323f89cdac18967e717d2ae3cbecda0595120b345cdea4d38e4a58abb","observation_id":"1be69628-62ac-4cfe-837a-f1bb61d3e937","resolution":{"observed_at":"2026-07-03T00:07:27.688520Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.09092","last_updated":"2020-12-16T17:21:13Z","snapshot_observed_at":"2026-08-13T02:05:24.095708Z","submitted_at":"2020-12-16T17:21:13Z","title":"Sample-Efficient Reinforcement Learning via Counterfactual-Based Data Augmentation","version":1},"cited_work":{"arxiv_id":"2012.09092","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2012.09092","snapshot_observed_at":"2026-07-04T00:29:16.028655Z","title":"arXiv preprint arXiv:2012.09092 , year=","venue":null,"work_id":"0d8fee82-7ddf-4fcf-b314-56341ae46835","year":2012},"citing_paper":{"arxiv_id":"2606.19460","last_updated":"2026-06-17T18:01:18Z","snapshot_observed_at":"2026-08-05T20:30:40.324830Z","submitted_at":"2026-06-17T18:01:18Z","title":"Scaling Generative Foundation Models for Chest Radiography with Rectified Flow Transformers","version":1},"reference_index":140,"source":"arxiv_source","source_observed_at":"2026-06-26T21:10:51.682435Z"},"links":{"cited_paper":"/paper/2012.09092","citing_paper":"/paper/2606.19460"},"observation_digest":"sha256:ce0f73b68fe696f73b4241df675ce87349c617a1c923646726406541adcb4f6f","observation_id":"2d8373cd-6720-4cd2-b9a7-a5a7a146cf20","resolution":{"observed_at":"2026-07-04T00:29:16.032558Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.09092","last_updated":"2020-12-16T17:21:13Z","snapshot_observed_at":"2026-08-13T02:05:24.095708Z","submitted_at":"2020-12-16T17:21:13Z","title":"Sample-Efficient Reinforcement Learning via Counterfactual-Based Data Augmentation","version":1},"cited_work":{"arxiv_id":"2012.09092","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2012.09092","snapshot_observed_at":"2026-07-04T00:29:16.028655Z","title":"arXiv preprint arXiv:2012.09092 , year=","venue":null,"work_id":"0d8fee82-7ddf-4fcf-b314-56341ae46835","year":2012},"citing_paper":{"arxiv_id":"2606.28460","last_updated":"2026-06-26T13:04:37Z","snapshot_observed_at":"2026-08-08T16:25:54.111144Z","submitted_at":"2026-06-26T13:04:37Z","title":"Counterfactual Residual Data Augmentation for Regression","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-30T01:16:27.768898Z"},"links":{"cited_paper":"/paper/2012.09092","citing_paper":"/paper/2606.28460"},"observation_digest":"sha256:454edc81502925e62d07585c3f5e16d63fb2884b29ab4b21cf0a13c00d08bc09","observation_id":"97d58044-c58f-413a-b3ce-6a02db0bea04","resolution":{"observed_at":"2026-07-01T15:35:48.876222Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2012.09092/citation-record","integrity":"/paper/2012.09092/integrity","json":"/paper/2012.09092/citation-record.json","paper":"/paper/2012.09092"},"outbound":[],"paper":{"arxiv_id":"2012.09092","last_updated":"2020-12-16T17:21:13Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T02:05:24.095708Z","submitted_at":"2020-12-16T17:21:13Z","title":"Sample-Efficient Reinforcement Learning via Counterfactual-Based Data Augmentation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2012.09092."}