{"as_of":"2026-08-20T05:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6716269c1fccab5e89c4e74f9912948dd327c8ab44c9775b4a4b2308416b8ac8","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:46:53.835259Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.06482/citation-record","integrity":"/paper/2505.06482/integrity","json":"/paper/2505.06482/citation-record.json","paper":"/paper/2505.06482"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:46:54.052826Z","title":"Each dataset consists of 200 trajectories, each with 500 time steps","venue":null,"work_id":"aa8d668e-1a75-4a05-93b3-b0312c8cea13","year":2017},"citing_paper":{"arxiv_id":"2505.06482","last_updated":"2025-05-17T09:20:41Z","snapshot_observed_at":"2026-08-15T23:52:44.128318Z","submitted_at":"2025-05-10T00:54:12Z","title":"Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T22:46:53.821399Z"},"links":{"citing_paper":"/paper/2505.06482"},"observation_digest":"sha256:9ef1d83c5ce274e4381d420a2be07df7bad66e02e3a2757071fc55ed6cb4e59a","observation_id":"796b0fab-28e7-4e62-a983-6d8e65473048","resolution":{"observed_at":"2026-08-15T22:46:54.056356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:46:54.063823Z","title":null,"venue":null,"work_id":"67d4fb8c-ce4d-45b2-80e2-882e79f46186","year":2019},"citing_paper":{"arxiv_id":"2505.06482","last_updated":"2025-05-17T09:20:41Z","snapshot_observed_at":"2026-08-15T23:52:44.128318Z","submitted_at":"2025-05-10T00:54:12Z","title":"Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T22:46:53.818060Z"},"links":{"citing_paper":"/paper/2505.06482"},"observation_digest":"sha256:bcf0b55b6615ad2f54466654532055a5624199ec8631775d35ceff10ac9cfcc2","observation_id":"56ec6d04-3fa2-437b-8544-fca2a0dc4914","resolution":{"observed_at":"2026-08-15T22:46:54.067802Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-08-16T08:32:46.407746Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-08-15T22:46:53.765796Z","title":"D4rl: Datasets for deep data-driven reinforcement learning","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.06482","last_updated":"2025-05-17T09:20:41Z","snapshot_observed_at":"2026-08-15T23:52:44.128318Z","submitted_at":"2025-05-10T00:54:12Z","title":"Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T22:46:53.765796Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2505.06482"},"observation_digest":"sha256:412cfb08b36fc7730944ec5afc876a5b8cb23b3a1891a4f4ee94ff1ac7884770","observation_id":"1f3bd618-e74d-49b4-aca4-09d0d1738174","resolution":{"observed_at":"2026-08-15T22:46:53.765796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-15T22:46:53.773239Z","title":"Mastering diverse domains through world models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.06482","last_updated":"2025-05-17T09:20:41Z","snapshot_observed_at":"2026-08-15T23:52:44.128318Z","submitted_at":"2025-05-10T00:54:12Z","title":"Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T22:46:53.773239Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2505.06482"},"observation_digest":"sha256:6a02479502e61922722d43a0c3ba4a006fa4d092fa48a4db2196a2b7c91ec749","observation_id":"a23675d9-727e-4746-9944-0e676ac289ce","resolution":{"observed_at":"2026-08-15T22:46:53.773239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:46:54.008865Z","title":"Handle Press w/ MMD loss w/o MMD loss DreamerV2 Episode return 2651± 620 1961 ± 585 1202 ± 422 Success rate 0.60± 0.12 0.45 ± 0.15 0.33 ± 0.11 W/ MMD loss W/o MMD loss Figure","venue":null,"work_id":"4da9d1f3-ae5f-4a12-a796-62366b8e4c47","year":1961},"citing_paper":{"arxiv_id":"2505.06482","last_updated":"2025-05-17T09:20:41Z","snapshot_observed_at":"2026-08-15T23:52:44.128318Z","submitted_at":"2025-05-10T00:54:12Z","title":"Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T22:46:53.835259Z"},"links":{"citing_paper":"/paper/2505.06482"},"observation_digest":"sha256:b172649612be2478ce07ae4fa0f5d65b3c373bd2a6016b3f35bc72c6a4f42c46","observation_id":"edb9085c-d3c5-49da-92c9-ff6dca96b0ff","resolution":{"observed_at":"2026-08-15T22:46:54.012721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-15T22:46:53.780499Z","title":"Offline rein- forcement learning: Tutorial, review, and perspectives on open problems","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.06482","last_updated":"2025-05-17T09:20:41Z","snapshot_observed_at":"2026-08-15T23:52:44.128318Z","submitted_at":"2025-05-10T00:54:12Z","title":"Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T22:46:53.780499Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2505.06482"},"observation_digest":"sha256:694b902ce2d6b798f35469651f0a312e6d671741badaad5b43bdd046683bf50a","observation_id":"ac7c549c-ee90-495f-97e9-17f11ec6b861","resolution":{"observed_at":"2026-08-15T22:46:53.780499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-15T22:46:53.791884Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.06482","last_updated":"2025-05-17T09:20:41Z","snapshot_observed_at":"2026-08-15T23:52:44.128318Z","submitted_at":"2025-05-10T00:54:12Z","title":"Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T22:46:53.791884Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.06482"},"observation_digest":"sha256:36dc3af60fedc5474d4c73374e6aba910a2f75ed866191434bf653cebe62fec7","observation_id":"225319e4-b757-4d5b-9c4f-323ee05c7d7d","resolution":{"observed_at":"2026-08-15T22:46:53.791884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08244","last_updated":"2022-12-16T02:23:50Z","snapshot_observed_at":"2026-08-19T19:43:43.780850Z","submitted_at":"2022-12-16T02:23:50Z","title":"Offline Reinforcement Learning for Visual Navigation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08244","snapshot_observed_at":"2026-08-15T22:46:53.795957Z","title":"Offline reinforcement learning for visual navigation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.06482","last_updated":"2025-05-17T09:20:41Z","snapshot_observed_at":"2026-08-15T23:52:44.128318Z","submitted_at":"2025-05-10T00:54:12Z","title":"Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T22:46:53.795957Z"},"links":{"cited_paper":"/paper/2212.08244","citing_paper":"/paper/2505.06482"},"observation_digest":"sha256:3084e3ddad27f574a2c75879fbec133d7f3a67a6a80ab29b03a79bbeca2e0a02","observation_id":"c1b438e2-2fe5-4c02-b0f5-68cf622ef4e5","resolution":{"observed_at":"2026-08-15T22:46:53.795957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.15373","last_updated":"2020-12-30T23:59:09Z","snapshot_observed_at":"2026-08-17T16:00:31.358510Z","submitted_at":"2020-12-30T23:59:09Z","title":"Model-Based Visual Planning with Self-Supervised Functional Distances","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.15373","snapshot_observed_at":"2026-08-15T22:46:53.799650Z","title":"Model-based visual planning with self-supervised functional distances","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.06482","last_updated":"2025-05-17T09:20:41Z","snapshot_observed_at":"2026-08-15T23:52:44.128318Z","submitted_at":"2025-05-10T00:54:12Z","title":"Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T22:46:53.799650Z"},"links":{"cited_paper":"/paper/2012.15373","citing_paper":"/paper/2505.06482"},"observation_digest":"sha256:4926d40f562c8d8bb74b9db581063a74042de37be6d76f51dc358e163047fc65","observation_id":"f0e71377-c170-4643-a7c2-ab4c4efdd6f1","resolution":{"observed_at":"2026-08-15T22:46:53.799650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.11361","last_updated":"2019-11-26T06:11:34Z","snapshot_observed_at":"2026-08-12T13:17:36.653110Z","submitted_at":"2019-11-26T06:11:34Z","title":"Behavior Regularized Offline Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.11361","snapshot_observed_at":"2026-08-15T22:46:53.807504Z","title":"Behavior regu- larized offline reinforcement learning","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2505.06482","last_updated":"2025-05-17T09:20:41Z","snapshot_observed_at":"2026-08-15T23:52:44.128318Z","submitted_at":"2025-05-10T00:54:12Z","title":"Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T22:46:53.807504Z"},"links":{"cited_paper":"/paper/1911.11361","citing_paper":"/paper/2505.06482"},"observation_digest":"sha256:2ff3f507a42023180cc19a38a3688bd2aa6dd0d5abc30cc68a5db30820f6c131","observation_id":"ef56a52a-c905-4ff0-a88b-4c82b3d112c1","resolution":{"observed_at":"2026-08-15T22:46:53.807504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:46:54.075208Z","title":"Offline visual representation learning for embodied nav- igation","venue":null,"work_id":"29fef386-90e8-441a-a332-5f4e8c839faa","year":2023},"citing_paper":{"arxiv_id":"2505.06482","last_updated":"2025-05-17T09:20:41Z","snapshot_observed_at":"2026-08-15T23:52:44.128318Z","submitted_at":"2025-05-10T00:54:12Z","title":"Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T22:46:53.811179Z"},"links":{"citing_paper":"/paper/2505.06482"},"observation_digest":"sha256:17f4e9f6018ec593e6ffcaa3fe39949765afda1031369c4044956ba0f99773ce","observation_id":"566ca729-ebd6-4c8e-9646-c519be0063c6","resolution":{"observed_at":"2026-08-15T22:46:54.078833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00887","last_updated":"2024-12-01T16:53:02Z","snapshot_observed_at":"2026-08-19T17:08:26.307658Z","submitted_at":"2024-12-01T16:53:02Z","title":"Playable Game Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00887","snapshot_observed_at":"2026-08-15T22:46:53.814417Z","title":"Playable game generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.06482","last_updated":"2025-05-17T09:20:41Z","snapshot_observed_at":"2026-08-15T23:52:44.128318Z","submitted_at":"2025-05-10T00:54:12Z","title":"Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T22:46:53.814417Z"},"links":{"cited_paper":"/paper/2412.00887","citing_paper":"/paper/2505.06482"},"observation_digest":"sha256:d05ccecd0da5e8979a025df240cc58e80b1f1d920e21235ef084cb9e79d6d3b9","observation_id":"0aa81737-1e58-414b-afa1-f080b49642fc","resolution":{"observed_at":"2026-08-15T22:46:53.814417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:46:54.042214Z","title":null,"venue":null,"work_id":"3d3f6add-a0cf-4036-824d-90ec01c2ccd7","year":2022},"citing_paper":{"arxiv_id":"2505.06482","last_updated":"2025-05-17T09:20:41Z","snapshot_observed_at":"2026-08-15T23:52:44.128318Z","submitted_at":"2025-05-10T00:54:12Z","title":"Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T22:46:53.825027Z"},"links":{"citing_paper":"/paper/2505.06482"},"observation_digest":"sha256:24ddd15c96d2554055564d45137f452f6d37d4aaed1d04167a30a4485ad1f70d","observation_id":"567e03dc-bd71-473e-8d99-e41f87769bbd","resolution":{"observed_at":"2026-08-15T22:46:54.045753Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:46:54.031278Z","title":"As the number of source domain videos increases, the model’s performance improves accordingly","venue":null,"work_id":"706c8f91-a42c-4414-94f6-83889c799719","year":2020},"citing_paper":{"arxiv_id":"2505.06482","last_updated":"2025-05-17T09:20:41Z","snapshot_observed_at":"2026-08-15T23:52:44.128318Z","submitted_at":"2025-05-10T00:54:12Z","title":"Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T22:46:53.828407Z"},"links":{"citing_paper":"/paper/2505.06482"},"observation_digest":"sha256:fa0036c6588fa5091b8190676907b72c69a96ae95fbfd4cb5780fb50be4a42bd","observation_id":"e6cb964e-91c8-4208-ab55-3ed58e643bb0","resolution":{"observed_at":"2026-08-15T22:46:54.034966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:46:54.020124Z","title":"• LOMPO (Rafailov et al., 2021): A model-based offline visual RL method that addresses model uncertainty in the latent space while incorporating explicit reward estimation","venue":null,"work_id":"c056890c-2df2-4390-9c20-affea9944339","year":2021},"citing_paper":{"arxiv_id":"2505.06482","last_updated":"2025-05-17T09:20:41Z","snapshot_observed_at":"2026-08-15T23:52:44.128318Z","submitted_at":"2025-05-10T00:54:12Z","title":"Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T22:46:53.831755Z"},"links":{"citing_paper":"/paper/2505.06482"},"observation_digest":"sha256:907d3b9d88842ae8b7264069ccdd8c1751d8107faba7b38c661679a8cf0e5005","observation_id":"c2802aea-4e39-4ef7-b428-cfdd6e7e29e0","resolution":{"observed_at":"2026-08-15T22:46:54.024042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.11027","last_updated":"2020-05-05T09:13:24Z","snapshot_observed_at":"2026-08-16T00:18:00.924587Z","submitted_at":"2019-03-26T17:19:56Z","title":"nuScenes: A multimodal dataset for autonomous driving","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.11027","snapshot_observed_at":"2026-08-15T22:46:53.757863Z","title":"H., V ora, S., Liong, V","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2505.06482","last_updated":"2025-05-17T09:20:41Z","snapshot_observed_at":"2026-08-15T23:52:44.128318Z","submitted_at":"2025-05-10T00:54:12Z","title":"Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach","version":2},"reference_index":2006,"source":"pdf_text","source_observed_at":"2026-08-15T22:46:53.757863Z"},"links":{"cited_paper":"/paper/1903.11027","citing_paper":"/paper/2505.06482"},"observation_digest":"sha256:cb613ccd35b5db9ed95c9e1c41598646b283412402ad2a73227023ec1868239c","observation_id":"4762985b-b92c-4635-83c6-c0949906a71c","resolution":{"observed_at":"2026-08-15T22:46:53.757863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14837","last_updated":"2025-04-24T03:03:57Z","snapshot_observed_at":"2026-08-14T07:06:06.462400Z","submitted_at":"2024-08-27T07:46:07Z","title":"Diffusion Models Are Real-Time Game Engines","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14837","snapshot_observed_at":"2026-08-15T22:46:53.803637Z","title":"Dif- fusion models are real-time game engines","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.06482","last_updated":"2025-05-17T09:20:41Z","snapshot_observed_at":"2026-08-15T23:52:44.128318Z","submitted_at":"2025-05-10T00:54:12Z","title":"Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-15T22:46:53.803637Z"},"links":{"cited_paper":"/paper/2408.14837","citing_paper":"/paper/2505.06482"},"observation_digest":"sha256:1c15f564baa568af205c6d807d56b8b511069fe6cf71d1f476e277ef0e7382c3","observation_id":"713f28c6-9624-4377-8efc-1676b708e9d0","resolution":{"observed_at":"2026-08-15T22:46:53.803637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08819","last_updated":"2024-03-11T14:43:52Z","snapshot_observed_at":"2026-08-16T14:26:59.204248Z","submitted_at":"2024-01-16T20:42:15Z","title":"Learning from Sparse Offline Datasets via Conservative Density Estimation","version":2},"cited_work":{"arxiv_id":"2401.08819","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.08819","snapshot_observed_at":"2026-08-15T22:46:53.973137Z","title":"Learning from Sparse Offline Datasets via Conservative Density Estimation","venue":"cs.LG","work_id":"783e2e88-5485-482d-a3fc-360380adfd63","year":2024},"citing_paper":{"arxiv_id":"2505.06482","last_updated":"2025-05-17T09:20:41Z","snapshot_observed_at":"2026-08-15T23:52:44.128318Z","submitted_at":"2025-05-10T00:54:12Z","title":"Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-15T22:46:53.761830Z"},"links":{"cited_paper":"/paper/2401.08819","citing_paper":"/paper/2505.06482"},"observation_digest":"sha256:e1a945ecbdb9eb91ad302e0c7341c9c6e471b049f486cf397ed78690c61b70b3","observation_id":"978c59c0-3aca-4c3a-b943-f82c650631f1","resolution":{"observed_at":"2026-08-15T22:46:53.979342Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:46:53.777139Z","title":"Crafting papers on machine learning","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2505.06482","last_updated":"2025-05-17T09:20:41Z","snapshot_observed_at":"2026-08-15T23:52:44.128318Z","submitted_at":"2025-05-10T00:54:12Z","title":"Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-15T22:46:53.777139Z"},"links":{"citing_paper":"/paper/2505.06482"},"observation_digest":"sha256:7483764ef6e167eb1e4568d85a1bae50c84cf94cc1263629014aa22ce2090552","observation_id":"04676327-30e0-4528-8a1b-53c363d355ab","resolution":{"observed_at":"2026-08-15T22:46:53.777139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:46:54.092388Z","title":"Off-policy deep reinforcement learning without exploration","venue":null,"work_id":"33c72d53-e702-4a12-9c28-0fac3376a853","year":null},"citing_paper":{"arxiv_id":"2505.06482","last_updated":"2025-05-17T09:20:41Z","snapshot_observed_at":"2026-08-15T23:52:44.128318Z","submitted_at":"2025-05-10T00:54:12Z","title":"Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-15T22:46:53.769668Z"},"links":{"citing_paper":"/paper/2505.06482"},"observation_digest":"sha256:51e3c13d59227475e8120bed4132feed48682a84cbe5e479d11c8e1c819ff25b","observation_id":"7d5256dd-200c-4d66-972a-9145d8d214a6","resolution":{"observed_at":"2026-08-15T22:46:54.096055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1308.3432","last_updated":"2013-08-15T15:19:34Z","snapshot_observed_at":"2026-08-14T04:51:04.817737Z","submitted_at":"2013-08-15T15:19:34Z","title":"Estimating or Propagating Gradients Through Stochastic Neurons for Conditional Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1308.3432","snapshot_observed_at":"2026-08-15T22:46:53.753217Z","title":"Estimating or propagating gradients through stochastic neurons for con- ditional computation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.06482","last_updated":"2025-05-17T09:20:41Z","snapshot_observed_at":"2026-08-15T23:52:44.128318Z","submitted_at":"2025-05-10T00:54:12Z","title":"Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-15T22:46:53.753217Z"},"links":{"cited_paper":"/paper/1308.3432","citing_paper":"/paper/2505.06482"},"observation_digest":"sha256:9a15787720917227f2b9d2c8632bb9fef41dd6f3918aa86b63cf36e7918a5acb","observation_id":"00032239-c86c-43d4-9920-87e7afb5804b","resolution":{"observed_at":"2026-08-15T22:46:53.753217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.12601","last_updated":"2022-11-18T05:57:09Z","snapshot_observed_at":"2026-08-11T08:36:53.636356Z","submitted_at":"2022-03-23T17:55:09Z","title":"R3M: A Universal Visual Representation for Robot Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.12601","snapshot_observed_at":"2026-08-15T22:46:53.784578Z","title":"R3m: A universal visual representation for robot manipulation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.06482","last_updated":"2025-05-17T09:20:41Z","snapshot_observed_at":"2026-08-15T23:52:44.128318Z","submitted_at":"2025-05-10T00:54:12Z","title":"Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-15T22:46:53.784578Z"},"links":{"cited_paper":"/paper/2203.12601","citing_paper":"/paper/2505.06482"},"observation_digest":"sha256:28638b4369c2798b8f12d1cb368c85888487db81a33f5c210909bcfa8068a825","observation_id":"2ae20b2a-9e34-4bfa-91cb-95ae38450133","resolution":{"observed_at":"2026-08-15T22:46:53.784578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.00177","last_updated":"2019-10-07T20:23:21Z","snapshot_observed_at":"2026-08-20T03:06:00.034814Z","submitted_at":"2019-10-01T02:23:38Z","title":"Advantage-Weighted Regression: Simple and Scalable Off-Policy Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.00177","snapshot_observed_at":"2026-08-15T22:46:53.788185Z","title":"B., Kumar, A., Zhang, G., and Levine, S","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2505.06482","last_updated":"2025-05-17T09:20:41Z","snapshot_observed_at":"2026-08-15T23:52:44.128318Z","submitted_at":"2025-05-10T00:54:12Z","title":"Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-15T22:46:53.788185Z"},"links":{"cited_paper":"/paper/1910.00177","citing_paper":"/paper/2505.06482"},"observation_digest":"sha256:724004c258c907071a306fad99400e3efbaf70e2fd35f66516e73bb29efa3a42","observation_id":"361532cc-98cb-4f36-ab05-2ccda35954e1","resolution":{"observed_at":"2026-08-15T22:46:53.788185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.06482","last_updated":"2025-05-17T09:20:41Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T23:52:44.128318Z","submitted_at":"2025-05-10T00:54:12Z","title":"Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":1,"verified_fuzzy":6},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2505.06482."}