{"as_of":"2026-08-07T00:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4c592333edffc9af8062f3a5103cb92bb04ca6d105f23595b8698248462113ed","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":22,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:34:41.901260Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T03:19:31.235420Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2007.05929","last_updated":"2021-05-20T09:15:57Z","snapshot_observed_at":"2026-08-04T15:40:58.037904Z","submitted_at":"2020-07-12T07:38:15Z","title":"Data-Efficient Reinforcement Learning with Self-Predictive Representations","version":4},"cited_work":{"arxiv_id":"2007.05929","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2007.05929","snapshot_observed_at":"2026-07-04T03:19:31.235420Z","title":"D., Courville, A., and Bachman, P","venue":null,"work_id":"dd401acf-5b85-4e74-ad8c-49274e40b5b7","year":2007},"citing_paper":{"arxiv_id":"2506.08902","last_updated":"2026-05-11T20:21:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-10T15:27:46Z","title":"Intention-Conditioned Flow Occupancy Models","version":4},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-19T10:24:52.160209Z"},"links":{"cited_paper":"/paper/2007.05929","citing_paper":"/paper/2506.08902"},"observation_digest":"sha256:46fc525e72a0d0aa9e838447107a45d5c4ab8ea06dcd60dc126fddebd6711cf9","observation_id":"db04718e-1378-4546-b164-cd9b2dd2f3b0","resolution":{"observed_at":"2026-05-19T10:27:14.543460Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05929","last_updated":"2021-05-20T09:15:57Z","snapshot_observed_at":"2026-08-04T15:40:58.037904Z","submitted_at":"2020-07-12T07:38:15Z","title":"Data-Efficient Reinforcement Learning with Self-Predictive Representations","version":4},"cited_work":{"arxiv_id":"2007.05929","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2007.05929","snapshot_observed_at":"2026-07-04T03:19:31.235420Z","title":"D., Courville, A., and Bachman, P","venue":null,"work_id":"dd401acf-5b85-4e74-ad8c-49274e40b5b7","year":2007},"citing_paper":{"arxiv_id":"2506.10137","last_updated":"2026-04-19T14:49:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-11T19:32:41Z","title":"Self-Predictive Representations for Combinatorial Generalization in Behavioral Cloning","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-19T09:15:45.511104Z"},"links":{"cited_paper":"/paper/2007.05929","citing_paper":"/paper/2506.10137"},"observation_digest":"sha256:b30551377fafd15170ec207a2006929da2292545e9e51535445b0ef9d6b3e5d3","observation_id":"1bc51aeb-a694-41a9-9a81-2578af3f264e","resolution":{"observed_at":"2026-05-19T09:17:14.006364Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05929","last_updated":"2021-05-20T09:15:57Z","snapshot_observed_at":"2026-08-04T15:40:58.037904Z","submitted_at":"2020-07-12T07:38:15Z","title":"Data-Efficient Reinforcement Learning with Self-Predictive Representations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.05929","snapshot_observed_at":"2026-08-06T23:34:41.901260Z","title":"Data-efficient reinforcement learning with self-predictive representations","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-06T23:28:04.803918Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":111,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:41.901260Z"},"links":{"cited_paper":"/paper/2007.05929","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:14605f7bf9eea2b64a5ca2aac416be1ce576a27f2aa317b80ec0c216ac4b1437","observation_id":"63fedd0e-50f5-4233-b480-487939272151","resolution":{"observed_at":"2026-08-06T23:34:41.901260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05929","last_updated":"2021-05-20T09:15:57Z","snapshot_observed_at":"2026-08-04T15:40:58.037904Z","submitted_at":"2020-07-12T07:38:15Z","title":"Data-Efficient Reinforcement Learning with Self-Predictive Representations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.05929","snapshot_observed_at":"2026-08-06T22:30:08.476025Z","title":"Pierre Sermanet, Corey Lynch, Yevgen Chebotar, Jasmine Hsu, Eric Jang, Stefan Schaal, Sergey Levine, and Google Brain","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2506.21367","last_updated":"2025-06-26T15:16:35Z","snapshot_observed_at":"2026-08-06T22:23:44.435650Z","submitted_at":"2025-06-26T15:16:35Z","title":"rQdia: Regularizing Q-Value Distributions With Image Augmentation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T22:30:08.476025Z"},"links":{"cited_paper":"/paper/2007.05929","citing_paper":"/paper/2506.21367"},"observation_digest":"sha256:ef01be8f9e9e5cb462ee99eacd766efc7667f14cab4b0620be43b57c9272a86a","observation_id":"93c144cf-2dc6-48fa-8e0a-d91d7ec9ec76","resolution":{"observed_at":"2026-08-06T22:30:08.476025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05929","last_updated":"2021-05-20T09:15:57Z","snapshot_observed_at":"2026-08-04T15:40:58.037904Z","submitted_at":"2020-07-12T07:38:15Z","title":"Data-Efficient Reinforcement Learning with Self-Predictive Representations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.05929","snapshot_observed_at":"2026-08-06T19:12:58.088970Z","title":"Data-efficient reinforcement learning with self-predictive representations,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2507.06326","last_updated":"2025-07-08T18:30:26Z","snapshot_observed_at":"2026-08-06T19:05:09.848320Z","submitted_at":"2025-07-08T18:30:26Z","title":"Sample-Efficient Reinforcement Learning Controller for Deep Brain Stimulation in Parkinson's Disease","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:12:58.088970Z"},"links":{"cited_paper":"/paper/2007.05929","citing_paper":"/paper/2507.06326"},"observation_digest":"sha256:5cb306a99e57eba692e31ff143f47d3b1ee716eb627ebf83903a659158f056d2","observation_id":"d81c0600-606e-4fb7-a4e2-bbbdbaeac6d6","resolution":{"observed_at":"2026-08-06T19:12:58.088970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05929","last_updated":"2021-05-20T09:15:57Z","snapshot_observed_at":"2026-08-04T15:40:58.037904Z","submitted_at":"2020-07-12T07:38:15Z","title":"Data-Efficient Reinforcement Learning with Self-Predictive Representations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.05929","snapshot_observed_at":"2026-08-06T15:55:36.073397Z","title":"Data-efficient reinforcement learning with self-predictive representations, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14736","last_updated":"2025-07-19T19:53:08Z","snapshot_observed_at":"2026-08-06T15:46:49.918611Z","submitted_at":"2025-07-19T19:53:08Z","title":"Balancing Expressivity and Robustness: Constrained Rational Activations for Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T15:55:36.073397Z"},"links":{"cited_paper":"/paper/2007.05929","citing_paper":"/paper/2507.14736"},"observation_digest":"sha256:5f83a867e6f9132c6adcaf6f81a70367840a16ce66542d5ec46736ac05a5675c","observation_id":"3c24405b-13cf-45ee-9636-e5c7338eda5b","resolution":{"observed_at":"2026-08-06T15:55:36.073397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05929","last_updated":"2021-05-20T09:15:57Z","snapshot_observed_at":"2026-08-04T15:40:58.037904Z","submitted_at":"2020-07-12T07:38:15Z","title":"Data-Efficient Reinforcement Learning with Self-Predictive Representations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.05929","snapshot_observed_at":"2026-08-04T08:03:20.231886Z","title":"Data-efficient reinforcement learning with self-predictive representations","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2510.23216","last_updated":"2026-06-02T10:40:21Z","snapshot_observed_at":"2026-08-04T08:03:02.093431Z","submitted_at":"2025-10-27T11:06:00Z","title":"Human-Like Goalkeeping in a Realistic Football Simulation: a Sample-Efficient Reinforcement Learning Approach","version":4},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T08:03:20.231886Z"},"links":{"cited_paper":"/paper/2007.05929","citing_paper":"/paper/2510.23216"},"observation_digest":"sha256:ee92423b85445ce3f6d16025597a6dcb7726ce2714a583225caa300b7d9aadc8","observation_id":"44b43f42-3d22-423e-804b-418aea13d67b","resolution":{"observed_at":"2026-08-04T08:03:20.231886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05929","last_updated":"2021-05-20T09:15:57Z","snapshot_observed_at":"2026-08-04T15:40:58.037904Z","submitted_at":"2020-07-12T07:38:15Z","title":"Data-Efficient Reinforcement Learning with Self-Predictive Representations","version":4},"cited_work":{"arxiv_id":"2007.05929","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2007.05929","snapshot_observed_at":"2026-07-04T03:19:31.235420Z","title":"D., Courville, A., and Bachman, P","venue":null,"work_id":"dd401acf-5b85-4e74-ad8c-49274e40b5b7","year":2007},"citing_paper":{"arxiv_id":"2603.07083","last_updated":"2026-04-14T13:41:32Z","snapshot_observed_at":"2026-07-06T22:48:13.053749Z","submitted_at":"2026-03-07T07:41:28Z","title":"Dreamer-CDP: Improving Reconstruction-free World Models Via Continuous Deterministic Representation Prediction","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-15T14:46:18.645009Z"},"links":{"cited_paper":"/paper/2007.05929","citing_paper":"/paper/2603.07083"},"observation_digest":"sha256:b3307408d9e1c8178a64d70de32206d3e0386e88c1a46f1b782b422985faaf86","observation_id":"1b91d14b-6869-4daa-ae7e-6b4283beb883","resolution":{"observed_at":"2026-05-15T14:50:05.076527Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05929","last_updated":"2021-05-20T09:15:57Z","snapshot_observed_at":"2026-08-04T15:40:58.037904Z","submitted_at":"2020-07-12T07:38:15Z","title":"Data-Efficient Reinforcement Learning with Self-Predictive Representations","version":4},"cited_work":{"arxiv_id":"2007.05929","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2007.05929","snapshot_observed_at":"2026-07-04T03:19:31.235420Z","title":"D., Courville, A., and Bachman, P","venue":null,"work_id":"dd401acf-5b85-4e74-ad8c-49274e40b5b7","year":2007},"citing_paper":{"arxiv_id":"2604.03023","last_updated":"2026-04-03T13:13:47Z","snapshot_observed_at":"2026-07-06T22:52:15.263364Z","submitted_at":"2026-04-03T13:13:47Z","title":"Behavior-Constrained Reinforcement Learning with Receding-Horizon Credit Assignment for High-Performance Control","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-13T19:30:23.447901Z"},"links":{"cited_paper":"/paper/2007.05929","citing_paper":"/paper/2604.03023"},"observation_digest":"sha256:ab29aa9dcd17211be6c9b2a73f695b7a3f178bf3e649865df9feb3866a63e222","observation_id":"308ea5c0-99ae-4d98-96ca-95b6ac0ed558","resolution":{"observed_at":"2026-05-13T19:33:10.238247Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05929","last_updated":"2021-05-20T09:15:57Z","snapshot_observed_at":"2026-08-04T15:40:58.037904Z","submitted_at":"2020-07-12T07:38:15Z","title":"Data-Efficient Reinforcement Learning with Self-Predictive Representations","version":4},"cited_work":{"arxiv_id":"2007.05929","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2007.05929","snapshot_observed_at":"2026-07-04T03:19:31.235420Z","title":"D., Courville, A., and Bachman, P","venue":null,"work_id":"dd401acf-5b85-4e74-ad8c-49274e40b5b7","year":2007},"citing_paper":{"arxiv_id":"2604.03208","last_updated":"2026-06-16T20:46:31Z","snapshot_observed_at":"2026-07-13T13:29:04.173053Z","submitted_at":"2026-04-03T17:32:36Z","title":"Hierarchical Planning with Latent World Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-13T20:13:58.991298Z"},"links":{"cited_paper":"/paper/2007.05929","citing_paper":"/paper/2604.03208"},"observation_digest":"sha256:b4898665e5133fa42be476e18e08e5c2ab3cbae9846c3c887582ab4423e8d735","observation_id":"16cf2cd0-cf7f-4dda-bd87-35236b489e52","resolution":{"observed_at":"2026-05-13T20:18:13.756848Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05929","last_updated":"2021-05-20T09:15:57Z","snapshot_observed_at":"2026-08-04T15:40:58.037904Z","submitted_at":"2020-07-12T07:38:15Z","title":"Data-Efficient Reinforcement Learning with Self-Predictive Representations","version":4},"cited_work":{"arxiv_id":"2007.05929","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2007.05929","snapshot_observed_at":"2026-07-04T03:19:31.235420Z","title":"D., Courville, A., and Bachman, P","venue":null,"work_id":"dd401acf-5b85-4e74-ad8c-49274e40b5b7","year":2007},"citing_paper":{"arxiv_id":"2604.15289","last_updated":"2026-04-16T17:53:16Z","snapshot_observed_at":"2026-07-06T23:02:53.677687Z","submitted_at":"2026-04-16T17:53:16Z","title":"Abstract Sim2Real through Approximate Information States","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-10T10:39:57.845600Z"},"links":{"cited_paper":"/paper/2007.05929","citing_paper":"/paper/2604.15289"},"observation_digest":"sha256:53fd2abc3ddb68378c8999249441acb9ba8541f2946b04644448d3755c0c884d","observation_id":"864bbf0c-aaa1-4dd7-b1cb-cb89dfaea35b","resolution":{"observed_at":"2026-05-10T10:44:38.083839Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05929","last_updated":"2021-05-20T09:15:57Z","snapshot_observed_at":"2026-08-04T15:40:58.037904Z","submitted_at":"2020-07-12T07:38:15Z","title":"Data-Efficient Reinforcement Learning with Self-Predictive Representations","version":4},"cited_work":{"arxiv_id":"2007.05929","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2007.05929","snapshot_observed_at":"2026-07-04T03:19:31.235420Z","title":"D., Courville, A., and Bachman, P","venue":null,"work_id":"dd401acf-5b85-4e74-ad8c-49274e40b5b7","year":2007},"citing_paper":{"arxiv_id":"2604.21130","last_updated":"2026-04-22T22:40:11Z","snapshot_observed_at":"2026-07-06T23:07:47.244208Z","submitted_at":"2026-04-22T22:40:11Z","title":"Self-Predictive Representation for Autonomous UAV Object-Goal Navigation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-09T23:31:49.766698Z"},"links":{"cited_paper":"/paper/2007.05929","citing_paper":"/paper/2604.21130"},"observation_digest":"sha256:b8238de64c27dab5b486addc9c3c821d9417fda84c81f644bd06c7f3704f69d4","observation_id":"79ac0ef4-a397-45fa-bbc5-90a7ef811000","resolution":{"observed_at":"2026-05-11T14:06:03.869664Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05929","last_updated":"2021-05-20T09:15:57Z","snapshot_observed_at":"2026-08-04T15:40:58.037904Z","submitted_at":"2020-07-12T07:38:15Z","title":"Data-Efficient Reinforcement Learning with Self-Predictive Representations","version":4},"cited_work":{"arxiv_id":"2007.05929","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2007.05929","snapshot_observed_at":"2026-07-04T03:19:31.235420Z","title":"D., Courville, A., and Bachman, P","venue":null,"work_id":"dd401acf-5b85-4e74-ad8c-49274e40b5b7","year":2007},"citing_paper":{"arxiv_id":"2605.00347","last_updated":"2026-05-01T02:05:56Z","snapshot_observed_at":"2026-07-06T23:13:47.082550Z","submitted_at":"2026-05-01T02:05:56Z","title":"Odysseus: Scaling VLMs to 100+ Turn Decision-Making in Games via Reinforcement Learning","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-05-09T20:22:58.061772Z"},"links":{"cited_paper":"/paper/2007.05929","citing_paper":"/paper/2605.00347"},"observation_digest":"sha256:dffd4ea2a01640d311b871d3b8c936f2dc332a8f33400fe041d14df198fcc039","observation_id":"2fd12924-e127-4769-bd31-e37d3ec5b271","resolution":{"observed_at":"2026-05-11T15:16:08.814352Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05929","last_updated":"2021-05-20T09:15:57Z","snapshot_observed_at":"2026-08-04T15:40:58.037904Z","submitted_at":"2020-07-12T07:38:15Z","title":"Data-Efficient Reinforcement Learning with Self-Predictive Representations","version":4},"cited_work":{"arxiv_id":"2007.05929","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2007.05929","snapshot_observed_at":"2026-07-04T03:19:31.235420Z","title":"D., Courville, A., and Bachman, P","venue":null,"work_id":"dd401acf-5b85-4e74-ad8c-49274e40b5b7","year":2007},"citing_paper":{"arxiv_id":"2605.07278","last_updated":"2026-05-08T05:43:33Z","snapshot_observed_at":"2026-08-01T00:55:28.214005Z","submitted_at":"2026-05-08T05:43:33Z","title":"Predictive but Not Plannable: RC-aux for Latent World Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-11T02:11:26.526418Z"},"links":{"cited_paper":"/paper/2007.05929","citing_paper":"/paper/2605.07278"},"observation_digest":"sha256:4255b6f617058219d2b39f2f6718dde04837234d4579feec80e0e84debca2730","observation_id":"acb10449-413e-4bd2-a7be-4c65ccc9e078","resolution":{"observed_at":"2026-05-11T03:50:57.219964Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05929","last_updated":"2021-05-20T09:15:57Z","snapshot_observed_at":"2026-08-04T15:40:58.037904Z","submitted_at":"2020-07-12T07:38:15Z","title":"Data-Efficient Reinforcement Learning with Self-Predictive Representations","version":4},"cited_work":{"arxiv_id":"2007.05929","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2007.05929","snapshot_observed_at":"2026-07-04T03:19:31.235420Z","title":"D., Courville, A., and Bachman, P","venue":null,"work_id":"dd401acf-5b85-4e74-ad8c-49274e40b5b7","year":2007},"citing_paper":{"arxiv_id":"2605.09364","last_updated":"2026-05-10T06:27:20Z","snapshot_observed_at":"2026-07-31T06:28:20.350355Z","submitted_at":"2026-05-10T06:27:20Z","title":"Multi-scale Predictive Representations for Goal-conditioned Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-12T03:35:37.739085Z"},"links":{"cited_paper":"/paper/2007.05929","citing_paper":"/paper/2605.09364"},"observation_digest":"sha256:219a43d8ef0727f4f3c6a4f087cc4982c8471847a2dbe9f3757ac798741b7e9d","observation_id":"ef9b80c9-0dc1-4021-925d-761bb39ee295","resolution":{"observed_at":"2026-05-12T07:16:26.310030Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05929","last_updated":"2021-05-20T09:15:57Z","snapshot_observed_at":"2026-08-04T15:40:58.037904Z","submitted_at":"2020-07-12T07:38:15Z","title":"Data-Efficient Reinforcement Learning with Self-Predictive Representations","version":4},"cited_work":{"arxiv_id":"2007.05929","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2007.05929","snapshot_observed_at":"2026-07-04T03:19:31.235420Z","title":"D., Courville, A., and Bachman, P","venue":null,"work_id":"dd401acf-5b85-4e74-ad8c-49274e40b5b7","year":2007},"citing_paper":{"arxiv_id":"2605.24517","last_updated":"2026-05-23T11:08:46Z","snapshot_observed_at":"2026-08-01T19:56:38.196339Z","submitted_at":"2026-05-23T11:08:46Z","title":"ECHO: Terminal Agents Learn World Models for Free","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T14:57:03.095107Z"},"links":{"cited_paper":"/paper/2007.05929","citing_paper":"/paper/2605.24517"},"observation_digest":"sha256:6582cbf71dd45fbdf7d82f7bd4fb15806492e60f4b6d88eb525fb4c378954f70","observation_id":"e22b60f7-f737-45f1-bdf4-862ca67203dc","resolution":{"observed_at":"2026-06-30T15:04:46.501267Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05929","last_updated":"2021-05-20T09:15:57Z","snapshot_observed_at":"2026-08-04T15:40:58.037904Z","submitted_at":"2020-07-12T07:38:15Z","title":"Data-Efficient Reinforcement Learning with Self-Predictive Representations","version":4},"cited_work":{"arxiv_id":"2007.05929","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2007.05929","snapshot_observed_at":"2026-07-04T03:19:31.235420Z","title":"D., Courville, A., and Bachman, P","venue":null,"work_id":"dd401acf-5b85-4e74-ad8c-49274e40b5b7","year":2007},"citing_paper":{"arxiv_id":"2605.25782","last_updated":"2026-05-26T02:20:50Z","snapshot_observed_at":"2026-08-03T21:15:11.785642Z","submitted_at":"2026-05-25T12:29:47Z","title":"ParkourFormer: Integrating Predictive Supervision and Sequence Modeling into Parkour Locomotion","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T21:37:13.833256Z"},"links":{"cited_paper":"/paper/2007.05929","citing_paper":"/paper/2605.25782"},"observation_digest":"sha256:07c2315d1e97f518cb732529824e551f4c6710161067cc3b1940b5c8a6ca143b","observation_id":"10d7ab89-9dcf-4f5d-990d-8842368fc212","resolution":{"observed_at":"2026-06-29T21:43:59.611385Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05929","last_updated":"2021-05-20T09:15:57Z","snapshot_observed_at":"2026-08-04T15:40:58.037904Z","submitted_at":"2020-07-12T07:38:15Z","title":"Data-Efficient Reinforcement Learning with Self-Predictive Representations","version":4},"cited_work":{"arxiv_id":"2007.05929","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2007.05929","snapshot_observed_at":"2026-07-04T03:19:31.235420Z","title":"D., Courville, A., and Bachman, P","venue":null,"work_id":"dd401acf-5b85-4e74-ad8c-49274e40b5b7","year":2007},"citing_paper":{"arxiv_id":"2605.27532","last_updated":"2026-05-26T18:06:19Z","snapshot_observed_at":"2026-07-06T23:37:12.630650Z","submitted_at":"2026-05-26T18:06:19Z","title":"SCALE-COMM: Shared, Contrastively-Aligned Latent Embeddings for MARL Communication","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-29T17:12:21.761535Z"},"links":{"cited_paper":"/paper/2007.05929","citing_paper":"/paper/2605.27532"},"observation_digest":"sha256:46be71bb31685fdbb806a21a74d902a9929be90314c39f6b4cf466523c517c2c","observation_id":"5cd1a620-781d-48d1-84a2-0666f1610554","resolution":{"observed_at":"2026-06-29T17:13:44.511218Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05929","last_updated":"2021-05-20T09:15:57Z","snapshot_observed_at":"2026-08-04T15:40:58.037904Z","submitted_at":"2020-07-12T07:38:15Z","title":"Data-Efficient Reinforcement Learning with Self-Predictive Representations","version":4},"cited_work":{"arxiv_id":"2007.05929","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2007.05929","snapshot_observed_at":"2026-07-04T03:19:31.235420Z","title":"D., Courville, A., and Bachman, P","venue":null,"work_id":"dd401acf-5b85-4e74-ad8c-49274e40b5b7","year":2007},"citing_paper":{"arxiv_id":"2606.18469","last_updated":"2026-06-16T20:28:39Z","snapshot_observed_at":"2026-08-03T05:02:29.489754Z","submitted_at":"2026-06-16T20:28:39Z","title":"Structured Representation Learning with Locally Linear Embeddings and Adaptive Feature Fusion","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-27T01:24:04.887225Z"},"links":{"cited_paper":"/paper/2007.05929","citing_paper":"/paper/2606.18469"},"observation_digest":"sha256:70f1112a59550678944443ec67b8aa9b4ba42e8c4ff28b857310be1617b8045a","observation_id":"223507fe-f61c-4e66-b364-8134ecbf89a3","resolution":{"observed_at":"2026-07-03T20:18:57.470577Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05929","last_updated":"2021-05-20T09:15:57Z","snapshot_observed_at":"2026-08-04T15:40:58.037904Z","submitted_at":"2020-07-12T07:38:15Z","title":"Data-Efficient Reinforcement Learning with Self-Predictive Representations","version":4},"cited_work":{"arxiv_id":"2007.05929","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2007.05929","snapshot_observed_at":"2026-07-04T03:19:31.235420Z","title":"D., Courville, A., and Bachman, P","venue":null,"work_id":"dd401acf-5b85-4e74-ad8c-49274e40b5b7","year":2007},"citing_paper":{"arxiv_id":"2606.20411","last_updated":"2026-06-18T15:58:48Z","snapshot_observed_at":"2026-08-02T04:44:49.376109Z","submitted_at":"2026-06-18T15:58:48Z","title":"Direct Advantage Estimation for Scalable and Sample-efficient Deep Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-26T18:12:00.111067Z"},"links":{"cited_paper":"/paper/2007.05929","citing_paper":"/paper/2606.20411"},"observation_digest":"sha256:d266593aae5cb38300e7d047fd5ec8a0f0aa7f3f8a7a8254f4f7d9b16448ddc4","observation_id":"015906af-65cb-4a51-b26d-6ec2cfeed68a","resolution":{"observed_at":"2026-07-04T03:19:31.238331Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05929","last_updated":"2021-05-20T09:15:57Z","snapshot_observed_at":"2026-08-04T15:40:58.037904Z","submitted_at":"2020-07-12T07:38:15Z","title":"Data-Efficient Reinforcement Learning with Self-Predictive Representations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.05929","snapshot_observed_at":"2026-08-01T16:26:17.964188Z","title":"arXiv preprint arXiv:2007.05929 , year=","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.18004","last_updated":"2026-07-20T14:36:11Z","snapshot_observed_at":"2026-08-06T05:05:25.917975Z","submitted_at":"2026-07-20T14:36:11Z","title":"PAMD: Structured Adaptive Distances for Bisimulation Representations in Visual Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-01T16:26:17.964188Z"},"links":{"cited_paper":"/paper/2007.05929","citing_paper":"/paper/2607.18004"},"observation_digest":"sha256:ca85762eb26c840a048fb6a5fd062f8b275e8fb78b439443d9c9c154425db51f","observation_id":"b3a18fbf-78e6-49f4-a2f1-ebcb1b4f1ffd","resolution":{"observed_at":"2026-08-01T16:26:17.964188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05929","last_updated":"2021-05-20T09:15:57Z","snapshot_observed_at":"2026-08-04T15:40:58.037904Z","submitted_at":"2020-07-12T07:38:15Z","title":"Data-Efficient Reinforcement Learning with Self-Predictive Representations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.05929","snapshot_observed_at":"2026-07-31T21:44:39.632400Z","title":"Data-efficient reinforcement learning with self-predictive representations.arXiv preprint arXiv:2007.05929, 2020","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.27973","last_updated":"2026-07-30T10:17:55Z","snapshot_observed_at":"2026-08-06T03:40:42.643302Z","submitted_at":"2026-07-30T10:17:55Z","title":"TAPO: Transition-Aware Policy Optimization for LLM Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-31T21:44:39.632400Z"},"links":{"cited_paper":"/paper/2007.05929","citing_paper":"/paper/2607.27973"},"observation_digest":"sha256:eaa41c367515df8f92a3a31483b6a25d6bfb94c18f403456cf03e1bd06c660ae","observation_id":"5328c020-c40e-4471-a32f-1bef29fd3f08","resolution":{"observed_at":"2026-07-31T21:44:39.632400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2007.05929/citation-record","integrity":"/paper/2007.05929/integrity","json":"/paper/2007.05929/citation-record.json","paper":"/paper/2007.05929"},"outbound":[],"paper":{"arxiv_id":"2007.05929","last_updated":"2021-05-20T09:15:57Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-04T15:40:58.037904Z","submitted_at":"2020-07-12T07:38:15Z","title":"Data-Efficient Reinforcement Learning with Self-Predictive Representations"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 22 inbound Pith citation observations for arXiv:2007.05929."}