{"as_of":"2026-08-08T20:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c3650c5481cbfde85ee0af071c43af7475e72ef39c18244025dc0c457d5d8d72","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T19:50:55.322592Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05989/citation-record","integrity":"/paper/2608.05989/integrity","json":"/paper/2608.05989/citation-record.json","paper":"/paper/2608.05989"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.106703Z","title":"The Tenth International Conference on Learning Representations,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.106703Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:82ce0b311ddc6e9e86d3cbffb107228f678987cfb5cc3ac8e04e92ebecba93fa","observation_id":"70f8bbf5-c083-499b-b138-7c55ee3bd0b0","resolution":{"observed_at":"2026-08-07T19:50:55.106703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.114149Z","title":"9th International Conference on Learning Representations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.114149Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:cbc6c78dfaa47832a041c284a7e15240eb3c30689dbbcbba1d0019753ea6e37a","observation_id":"33b3baf7-d1ec-4b1a-80f2-0eb2c0550e4f","resolution":{"observed_at":"2026-08-07T19:50:55.114149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.119713Z","title":"The Thirteenth International Conference on Learning Representations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.119713Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:e96784bc89ea6c3abb83a0c92435c9a1045adb8b3fd6ada8929dec386704d728","observation_id":"f02c9844-45e2-437b-95fe-46b31e5f34e5","resolution":{"observed_at":"2026-08-07T19:50:55.119713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:56.063404Z","title":"2026 , eprint=","venue":null,"work_id":"c9cb9804-2e37-4e56-9f20-add9da8339b9","year":2026},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.124553Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:e6ff50f8c7a61e2cd7840dde20f1a15d18e8107299ee45a557273443e7bd7290","observation_id":"f333489d-8b9f-4a9b-abbc-5e8f0786ba82","resolution":{"observed_at":"2026-08-07T19:50:56.068255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.129452Z","title":"Devon Hjelm and Aaron C","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.129452Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:7ad49affcd2ee54bcd8c4477502f018dfde9ce7107f1f98eb269da51848e5404","observation_id":"f2aa81e2-72f6-4033-a656-fd0b2c1475bf","resolution":{"observed_at":"2026-08-07T19:50:55.129452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.136530Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.136530Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:a848bb94c07d1dab53595b59065a9cd9fe7b76fa045bec0f79993d6aceadb7d3","observation_id":"2ba98ed0-caf9-44d3-9e3c-2405716ab346","resolution":{"observed_at":"2026-08-07T19:50:55.136530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05418","last_updated":"2025-06-05T00:36:54Z","snapshot_observed_at":"2026-08-07T10:37:36.418683Z","submitted_at":"2025-06-05T00:36:54Z","title":"Self-Predictive Dynamics for Generalization of Vision-based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05418","snapshot_observed_at":"2026-08-07T19:50:55.142822Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.142822Z"},"links":{"cited_paper":"/paper/2506.05418","citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:4f4ad866e270c58948cacbc86bb03f90c59e2a91071833b8b3ab6c2ee1b37881","observation_id":"3099247d-7847-415c-9bac-1e74d0e232df","resolution":{"observed_at":"2026-08-07T19:50:55.142822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.150547Z","title":"Bootstrap Your Own Latent -","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.150547Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:7870f359bd7e113b958906b57cd14d19f53f1bee5f99fc98a1768e3e03e98db6","observation_id":"2e8097b2-c833-40da-88d5-b4d0b9abc10f","resolution":{"observed_at":"2026-08-07T19:50:55.150547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.155467Z","title":"Bellemare , editor =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.155467Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:bce261143dc2ac2ada4726c99488c99515a039d88d99f5e88328a34eaca3d4b4","observation_id":"742550d0-9639-456b-a81a-e0d3a570360a","resolution":{"observed_at":"2026-08-07T19:50:55.155467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.160692Z","title":"Nature , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.160692Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:71240ada1e31d429f970438542b76721b7562609ae67ab3bed5e125dfd64e30c","observation_id":"5bc959e7-1b58-4254-a4d1-f719f17cba5e","resolution":{"observed_at":"2026-08-07T19:50:55.160692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.164893Z","title":"The Twelfth International Conference on Learning Representations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.164893Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:228218171ecf7cdb3591c9c5cdfacd6817b4c425e6ca0e6a037e999132d03584","observation_id":"7a64627a-3197-4021-89b2-d60bd8df7b62","resolution":{"observed_at":"2026-08-07T19:50:55.164893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.170051Z","title":"1998 , publisher=","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.170051Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:7f78b0913036c560e47d5303b5137faf11aef21123b31d0487167391ff2d68b7","observation_id":"c2607cca-0233-43f1-99d7-ce112c7cb423","resolution":{"observed_at":"2026-08-07T19:50:55.170051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.00690","last_updated":"2018-01-02T15:48:14Z","snapshot_observed_at":"2026-08-01T20:24:08.300098Z","submitted_at":"2018-01-02T15:48:14Z","title":"DeepMind Control Suite","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.00690","snapshot_observed_at":"2026-08-07T19:50:55.174248Z","title":"Lillicrap and Martin A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.174248Z"},"links":{"cited_paper":"/paper/1801.00690","citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:63b4bcb9b3d4a51f4c99feeaccb6702b113a8c96ac0678375f67177c4aba87b8","observation_id":"6b8bd82d-8b77-42f1-9d24-19a98fe5eaa5","resolution":{"observed_at":"2026-08-07T19:50:55.174248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.179439Z","title":"Learning Representations via a Robust Behavioral Metric for Deep Reinforcement Learning , booktitle =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.179439Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:efdf566965a5cccf5b428fa76e417ff7b84944e21c76b4e1b57e53e1e7f69354","observation_id":"7ebaee02-974c-435c-96a0-778d6b48168d","resolution":{"observed_at":"2026-08-07T19:50:55.179439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.184306Z","title":"MICo: Improved representations via sampling-based state similarity for Markov decision processes , booktitle =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.184306Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:73d56d0b11af567442a45a1fab3adeea17b947290aae50a2514159bb8832bffa","observation_id":"5470763c-854e-4486-aed0-a4f90b8b1abb","resolution":{"observed_at":"2026-08-07T19:50:55.184306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.188694Z","title":"The Twelfth International Conference on Learning Representations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.188694Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:e27e8c274febc1cf4b8f8a835d3ccabb9f29e4e50aca7ff8a9657c2eff6ad49d","observation_id":"8380536b-f784-4b7e-b026-a5f9f8dd37d6","resolution":{"observed_at":"2026-08-07T19:50:55.188694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.192580Z","title":"Why do We Need Large Batchsizes in Contrastive Learning?","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.192580Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:6b307bbe79560f110c9a50eb4f8e832a7b1d73788f8380d4366bbc4f21080063","observation_id":"2aa67b88-d9a5-4ffb-8831-2837a4577fa5","resolution":{"observed_at":"2026-08-07T19:50:55.192580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.196626Z","title":"Contrastive Learning as Goal-Conditioned Reinforcement Learning , booktitle =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.196626Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:98e213c57f7dc7d641304e6bd74a5718ba9ec4fb6119cefe5552444ce886d014","observation_id":"f0b19d9e-6c6d-496e-a00e-35464c474cf5","resolution":{"observed_at":"2026-08-07T19:50:55.196626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.200769Z","title":"The Thirteenth International Conference on Learning Representations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.200769Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:4b567614f577a9b08086ce3e1cac7b719be6ea1df58b332202cd90f4cf1a4ea2","observation_id":"ed2aae50-3ac5-443f-8856-d497d0375c09","resolution":{"observed_at":"2026-08-07T19:50:55.200769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.204994Z","title":"Policy-Independent Behavioral Metric-Based Representation for Deep Reinforcement Learning , booktitle =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.204994Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:30f8937a88abecd305a540ec19a17ca67dd2203858d7dcb9c2efef0bfe53b843","observation_id":"2683690d-ce08-4a86-b381-375cdc591bcc","resolution":{"observed_at":"2026-08-07T19:50:55.204994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2507.18519","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:28:40.151424Z","title":"Revisiting Bisimulation Metric for Robust Representations in Reinforcement Learning , journal =","venue":null,"work_id":"9e78990c-c2d1-4575-b067-0d762bdc9577","year":2025},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.209108Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:e657e5f21a3619375fbc98e2e6560d09a3796a839ac79381c0bf2039d894d82a","observation_id":"16ca6a2f-4eed-4c5b-b680-5122ed05b2be","resolution":{"observed_at":"2026-08-07T20:28:40.158365Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.213520Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.213520Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:2ecb2958e0b7389d8fee7f43226f71d71e1b936a5e9dd266af6206ba2cab3b81","observation_id":"c460febb-5bb8-4876-9045-1277b32e1f2b","resolution":{"observed_at":"2026-08-07T19:50:55.213520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.218002Z","title":"Jha and Toshisada Mariyama and Daniel Nikovski , title =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.218002Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:0f0617e716362b7a790b0024a281f89f0fe455ca35cd72115ec1b26c7f5ae877","observation_id":"ed64c26d-bea8-4255-9f60-ae6046beac66","resolution":{"observed_at":"2026-08-07T19:50:55.218002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.222580Z","title":"Lillicrap and Jimmy Ba and Mohammad Norouzi , title =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.222580Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:24712ab41fb2b192166b89da83d2029b966676afd41c640926ceeecdc49a1a86","observation_id":"8289d601-ef67-4ff0-a70d-962a4d4a88f9","resolution":{"observed_at":"2026-08-07T19:50:55.222580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.227135Z","title":"Lillicrap and Mohammad Norouzi and Jimmy Ba , title =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.227135Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:c1583c86333bfd78fb5a0b8efafb9f5528efa2bc30db3b9bacf9c448746d4e50","observation_id":"28f58bd8-0901-41a2-82cd-026e8f5dca28","resolution":{"observed_at":"2026-08-07T19:50:55.227135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.231756Z","title":"Addressing Function Approximation Error in Actor-Critic Methods , booktitle =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.231756Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:7bbfbca51ff90ce3f6b0249a154f1fc585d02b6cbe37f7f725257e0ded9586ae","observation_id":"ef18c18d-6712-40fb-9ce8-2d130f536c07","resolution":{"observed_at":"2026-08-07T19:50:55.231756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.605260Z","title":null,"venue":null,"work_id":"15479738-82f4-434d-86ec-e17de808f808","year":2012},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.235969Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:494dc180ec4233a63b3f5c13610228cfe4e271d775262b77908b93b92dcb6c51","observation_id":"9664dc32-8ab1-4c3c-bf79-8d8b0e49c25c","resolution":{"observed_at":"2026-08-07T19:50:55.725061Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.240605Z","title":"PyTorch: An Imperative Style, High-Performance Deep Learning Library , booktitle =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.240605Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:fa30b1868cf9fda2a56fede1f24848c6ca15324709c30565bceabd80ee1f8281","observation_id":"387b0585-0ad9-44dc-b0dd-ee4973e7dd0b","resolution":{"observed_at":"2026-08-07T19:50:55.240605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.245059Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.245059Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:405bd3d8f98beaed4a6b89fc17494b49ac961b33422a5b4473a31453c61d3f17","observation_id":"a93136d4-f3e5-4371-bd47-17651c25987e","resolution":{"observed_at":"2026-08-07T19:50:55.245059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.249557Z","title":"Bellemare and Yavar Naddaf and Joel Veness and Michael Bowling , title =","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.249557Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:20ef0ae3ad04e2da1654565cc22c591f6b5936fe033ee1fe485ac2b523c1f312","observation_id":"1f1560d1-cc78-49a0-8e93-a3348a4d7dfc","resolution":{"observed_at":"2026-08-07T19:50:55.249557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02696","last_updated":"2024-06-04T18:15:44Z","snapshot_observed_at":"2026-08-03T10:05:14.805466Z","submitted_at":"2024-06-04T18:15:44Z","title":"iQRL -- Implicitly Quantized Representations for Sample-efficient Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02696","snapshot_observed_at":"2026-08-07T19:50:55.254650Z","title":"iQRL - Implicitly Quantized Representations for Sample-efficient Reinforcement Learning , journal =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.254650Z"},"links":{"cited_paper":"/paper/2406.02696","citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:c20709cb4c67ce26c489d25b328916c69e636161ccf6f7e4c24b908ab47d42aa","observation_id":"0a611bef-90f0-4ad1-9dab-3692975237b0","resolution":{"observed_at":"2026-08-07T19:50:55.254650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.260065Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.260065Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:3cc7892e2294c179d19d0894fd317416b10681e7b02b5f846d0eeb12e7c956bb","observation_id":"abc2af7a-487c-4aec-aea6-9b90659cbd4e","resolution":{"observed_at":"2026-08-07T19:50:55.260065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.264601Z","title":"Riedmiller , title =","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.264601Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:2ef8a7dcbff89a9189be75f64d1b34d1bc3a47c995d4e0cf9c08a34f69159a05","observation_id":"752608e7-b9b6-409c-8b2b-3dbfb8dd66d9","resolution":{"observed_at":"2026-08-07T19:50:55.264601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.269609Z","title":"Lillicrap and David Silver , title =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.269609Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:7d41f8becc3a1a45a827d6d02774a7a0c9f4516850a7a0bb6ca8ebdfcf4deb04","observation_id":"092a16b1-f764-431a-b83d-c425b2d5de6d","resolution":{"observed_at":"2026-08-07T19:50:55.269609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.274985Z","title":"Dueling Network Architectures for Deep Reinforcement Learning , booktitle =","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.274985Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:1c3f629dd3f694f127a65cf82e46d9f92846cc1192d57fb4cd7a2e1714a54c1c","observation_id":"828aa1f2-a9c7-4ed1-8d74-fcdb39e16650","resolution":{"observed_at":"2026-08-07T19:50:55.274985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.280007Z","title":"Temporal Difference Learning for Model Predictive Control , booktitle =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.280007Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:daa335eaa47a2324cc262dd19bd842a9a3348f919650f944801f4671d78b8a99","observation_id":"c1e32949-7edd-4447-a08e-4449724fc160","resolution":{"observed_at":"2026-08-07T19:50:55.280007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-07T19:50:55.284821Z","title":"Riedmiller , title =","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.284821Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:8ec228329da80a3abab9aeaaf7677fe5714941ee75d26165febd7d04ea2b9bda","observation_id":"801d486f-df15-4acb-9347-360e6b15700d","resolution":{"observed_at":"2026-08-07T19:50:55.284821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.290014Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.290014Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:e7bbaf3b58518e354ec83f2005899ff63a1edff510a7d4e3d85df067240f295f","observation_id":"61c003ba-2668-4556-b96e-a77f5f106b79","resolution":{"observed_at":"2026-08-07T19:50:55.290014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.294231Z","title":"An Equivalence between Loss Functions and Non-Uniform Sampling in Experience Replay , booktitle =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.294231Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:6140144b476f02656078a5f6a24160db3f4de9f479c1c412913e7ff7fb2a3994","observation_id":"aaaaff90-c96b-4c44-80b3-bdce4bb00364","resolution":{"observed_at":"2026-08-07T19:50:55.294231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.298383Z","title":"7th International Conference on Learning Representations,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.298383Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:0c0e68fb5f8871039e5ae84fe8eb906322b5ef9f09dae3357bfd1356ca04630d","observation_id":"0e38009e-4199-4e00-b127-93432429b884","resolution":{"observed_at":"2026-08-07T19:50:55.298383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.302389Z","title":"Rusu and Joel Veness and Marc G","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.302389Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:2940462fad6906fec6f13463354f582bc6477484aae3f296f98abe93c0fe86a5","observation_id":"c75dcacf-ab62-478b-b56c-298d2110f20c","resolution":{"observed_at":"2026-08-07T19:50:55.302389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.306714Z","title":"Rainbow: Combining Improvements in Deep Reinforcement Learning , booktitle =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.306714Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:6b4480c42af8ef09b283b1f7dadd660801aaf817218466c11bc57cffb3d29a42","observation_id":"6b0fe33d-156b-4fc2-aac7-c2da019b261e","resolution":{"observed_at":"2026-08-07T19:50:55.306714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.310725Z","title":"Bridging State and History Representations: Understanding Self-Predictive","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.310725Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:1028d5bb7508a0e5eb7487b85e441173ebcc68e6843c46fb4cf28764d439866a","observation_id":"e2125a36-ed36-42ae-8eb3-82a80433d8e9","resolution":{"observed_at":"2026-08-07T19:50:55.310725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.781442Z","title":"When does Self-Prediction help? Understanding Auxiliary Tasks in Reinforcement Learning , journal =","venue":null,"work_id":"fc52aafa-e7f0-4214-8fed-d023867e47c1","year":2024},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.314650Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:5122735ee28626c3e616841015cf937527f727a439f72c3fefee5f3a1c54a996","observation_id":"a7e79f2c-9482-446a-9e76-e0b77d3e95c7","resolution":{"observed_at":"2026-08-07T19:50:55.786798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.763223Z","title":null,"venue":null,"work_id":"32c9729b-d315-4576-b4bb-ae2b8f46c8d2","year":null},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.318512Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:13b2b876385a9e2e1bd223949242dfd9d76710f54dc8b2276ce7ebea3b6046e5","observation_id":"b2f98dab-07fc-4322-8d22-b1af9b9e4d3e","resolution":{"observed_at":"2026-08-07T19:50:55.768511Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.322592Z","title":"2026 , note =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.322592Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:a157d95164f48f198526eab4e73c398a02798c9c753254c9613b5ba6fc94a09f","observation_id":"4fa723eb-1088-43f5-95c8-91dcf55d2267","resolution":{"observed_at":"2026-08-07T19:50:55.322592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T19:17:18.230839Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":2,"verified_fuzzy":2},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 0 inbound Pith citation observations for arXiv:2608.05989."}