{"as_of":"2026-08-20T09:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6ba5050c9b1a0aa4954e6a4d0a1481929e9a5a9220b2b64988b2710b2346d90d","coverage":[{"denominator":64,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":64,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:36:10.142957Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.19643/citation-record","integrity":"/paper/2506.19643/integrity","json":"/paper/2506.19643/citation-record.json","paper":"/paper/2506.19643"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:09.848438Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.848438Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:00bc09781deaad7233126a2670b14e40bdb99fb6a5ae152793b007b1169b7151","observation_id":"d3f0525a-a4c1-4c41-bb53-cfa33140c607","resolution":{"observed_at":"2026-08-15T18:36:09.848438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:09.853778Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.853778Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:54440d31f0590cae2410e1bb9fd2f46b3c860f4eee1d3ac3481f0e19c723d44e","observation_id":"bc6de0c3-84a3-461d-97ab-c8efbb59cb84","resolution":{"observed_at":"2026-08-15T18:36:09.853778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.04543","last_updated":"2020-06-22T04:32:50Z","snapshot_observed_at":"2026-08-19T07:08:13.370208Z","submitted_at":"2019-07-10T07:23:27Z","title":"An Optimistic Perspective on Offline Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.04543","snapshot_observed_at":"2026-08-15T18:36:09.858826Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.858826Z"},"links":{"cited_paper":"/paper/1907.04543","citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:fdf4a75d42c4be6766efc4f2c32835844723aeed4ab5d7b2198bb8773c6390f3","observation_id":"1117a066-44c2-4bd7-b802-01f651e014bb","resolution":{"observed_at":"2026-08-15T18:36:09.858826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.04862","last_updated":"2017-01-17T20:46:21Z","snapshot_observed_at":"2026-08-15T11:23:36.583037Z","submitted_at":"2017-01-17T20:46:21Z","title":"Towards Principled Methods for Training Generative Adversarial Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.04862","snapshot_observed_at":"2026-08-15T18:36:09.864641Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.864641Z"},"links":{"cited_paper":"/paper/1701.04862","citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:867f1beeb775525891c7d98e5a849b7823178914540887e958f4da9d9b37a303","observation_id":"d731046d-aa75-40df-b0b8-80c1e36ec8bc","resolution":{"observed_at":"2026-08-15T18:36:09.864641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:09.869556Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.869556Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:7865d6061be8cae37fe1b0fb1ab8d94fd956529ecfc8eb66043cce5a820f6898","observation_id":"20dc4aa3-1074-404d-b52e-7157adef09bc","resolution":{"observed_at":"2026-08-15T18:36:09.869556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.810083Z","title":"o r \\\"o czky Jr, K.; B \\","venue":null,"work_id":"b974755b-5e57-45b5-b4cf-9874ca3186e1","year":2004},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.874225Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:5db79adf3a6523077b872818e5b2b24eb002671cf5afed464a955a05af9b7717","observation_id":"62c88026-7079-43d8-998d-82dbfb9855ec","resolution":{"observed_at":"2026-08-15T18:36:10.814342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-08-13T12:26:05.192883Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-08-15T18:36:09.878512Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.878512Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:cddb6c7fab371fbfe373fdb0bda72c4d32d2a9fd17d878ebb5fd3dc51afac039","observation_id":"731d8f07-729d-4b0f-9d6a-2ac00a680de5","resolution":{"observed_at":"2026-08-15T18:36:09.878512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.12894","last_updated":"2018-10-30T17:44:42Z","snapshot_observed_at":"2026-08-14T18:06:54.993797Z","submitted_at":"2018-10-30T17:44:42Z","title":"Exploration by Random Network Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.12894","snapshot_observed_at":"2026-08-15T18:36:09.882655Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.882655Z"},"links":{"cited_paper":"/paper/1810.12894","citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:de2cea70c60adb7f95e4605107034f924dfface42151a799650a2797c318ab2a","observation_id":"e88e430f-9157-4028-b937-291318464e5e","resolution":{"observed_at":"2026-08-15T18:36:09.882655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.799187Z","title":null,"venue":null,"work_id":"5fb70d08-1602-4a3d-8f35-1caad77a64c9","year":2020},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.887159Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:32f4a1ffce12c4ce0fd92038a7d16e7e6d04d4b1eaae6cb03c9f4c2545744e19","observation_id":"575c7de0-5ac7-42d7-b732-cfc08afc12f3","resolution":{"observed_at":"2026-08-15T18:36:10.802641Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.788199Z","title":null,"venue":null,"work_id":"695983eb-1d10-4dd4-a94f-36554de1ad8c","year":2019},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.891060Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:77a1fb83c548107e0f62e648f65e5e126344178f38bcbf6a5af727e85e5a6dab","observation_id":"2f962931-dcac-48f6-8555-7b0306c6b9d6","resolution":{"observed_at":"2026-08-15T18:36:10.791729Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.776186Z","title":null,"venue":null,"work_id":"20305f37-c97e-40e8-bc47-d1064792e660","year":2004},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.895029Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:668326b876899c99e4961cf293a1a8bf3da428c925c06141d070fc5000e0426f","observation_id":"8efe44ca-4145-4f95-9921-2a59c3d236de","resolution":{"observed_at":"2026-08-15T18:36:10.780057Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.763790Z","title":null,"venue":null,"work_id":"317b7e5c-5d97-48b1-b1b9-e92a07b61b15","year":2021},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.899684Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:130af4b3ea9489856e6157885500bb6e96ee10dbc62a2eeafe2c56d41c772896","observation_id":"fba74a87-35ee-4ae9-87af-c3b8b29cde60","resolution":{"observed_at":"2026-08-15T18:36:10.768179Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.751765Z","title":null,"venue":null,"work_id":"b9c497b7-16f8-4205-9636-76331b10d625","year":2022},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.904304Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:0fd8ab99a4093bfa120d00a1e1802929e6cd956a8cbeeed85129e2fcf6ca4017","observation_id":"5e527d25-9195-4472-aed0-765778f781b1","resolution":{"observed_at":"2026-08-15T18:36:10.755379Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:09.908811Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.908811Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:b46ee16a2ed9b4732678842dff3126e96c33f32f8730b462bea7cb9eb5beadd4","observation_id":"74b04811-9178-4db3-9589-bb4dced63585","resolution":{"observed_at":"2026-08-15T18:36:09.908811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.02719","last_updated":"2021-10-06T13:08:36Z","snapshot_observed_at":"2026-08-20T08:56:29.973952Z","submitted_at":"2021-10-06T13:08:36Z","title":"The Information Geometry of Unsupervised Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2110.02719","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.02719","snapshot_observed_at":"2026-08-15T18:36:10.342220Z","title":"The Information Geometry of Unsupervised Reinforcement Learning","venue":"cs.LG","work_id":"7bf37940-8a61-4457-ab1d-684eb05d54f5","year":2021},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.914158Z"},"links":{"cited_paper":"/paper/2110.02719","citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:52ae59de88be8100f288a50db2a1686a6a09cec82e30dbd2b81d675502a8c67e","observation_id":"bca5538b-5f1c-4343-90c2-6448ad18a6df","resolution":{"observed_at":"2026-08-15T18:36:10.348434Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.03012","last_updated":"2017-04-10T18:41:28Z","snapshot_observed_at":"2026-08-14T21:07:25.023391Z","submitted_at":"2017-04-10T18:41:28Z","title":"Stochastic Neural Networks for Hierarchical Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.03012","snapshot_observed_at":"2026-08-15T18:36:09.919242Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.919242Z"},"links":{"cited_paper":"/paper/1704.03012","citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:3b8c631d3e781c3cc00a154f0fe72035a116799b1d1c3fba5a20f6008938f8eb","observation_id":"eabc7a8e-bf5d-47f3-992b-1390ce399297","resolution":{"observed_at":"2026-08-15T18:36:09.919242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07219","last_updated":"2021-02-06T01:57:28Z","snapshot_observed_at":"2026-08-16T08:32:46.407746Z","submitted_at":"2020-04-15T17:18:19Z","title":"D4RL: Datasets for Deep Data-Driven Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07219","snapshot_observed_at":"2026-08-15T18:36:09.923518Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.923518Z"},"links":{"cited_paper":"/paper/2004.07219","citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:9a993f0e7163f514ce88cf3805ce981fafc48eabfd3c0e154a9232bc0a03ad19","observation_id":"b1611cd4-2019-4c60-bff9-850536e3ef24","resolution":{"observed_at":"2026-08-15T18:36:09.923518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:09.927987Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.927987Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:7d8ef9929db0ef2c4534fa0360e95229af37d54e49814cda168ab4c5f7e920e6","observation_id":"48998988-6c5b-4019-b4b4-411b7dac9a88","resolution":{"observed_at":"2026-08-15T18:36:09.927987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:09.932873Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.932873Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:3459bd642273c381ce855c8f837da485aa1fb2184297b32b335a2fc9ce3b3416","observation_id":"0e517465-e234-48d7-96d2-08f1ac238a94","resolution":{"observed_at":"2026-08-15T18:36:09.932873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:09.937879Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.937879Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:0ffa0f70f81ba71f63ba9e494bb83129cc0ea46f837abfe574bf0048832fc568","observation_id":"adb02f22-2f36-431a-8852-edd56e2981c8","resolution":{"observed_at":"2026-08-15T18:36:09.937879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.712765Z","title":"S.; Mankowitz, D","venue":null,"work_id":"30c5e967-3e92-4c1d-ae30-ef4293b2e502","year":2020},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.942039Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:26a4c440cd82ad7887fb7acdcab0a418f144483cedcd1707201b827404360da5","observation_id":"7d3c820c-5844-40f7-a43e-c29587cacede","resolution":{"observed_at":"2026-08-15T18:36:10.716586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:09.945875Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.945875Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:909e945f8c8e38892166fe8ac8cfd2adbec6434952bf5c66827717aa4a157ea0","observation_id":"a2b02dfa-3a0f-4c75-aa43-0cec47398c54","resolution":{"observed_at":"2026-08-15T18:36:09.945875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.694769Z","title":null,"venue":null,"work_id":"3fb9e096-f311-4b2e-9678-3b5869ce1500","year":2022},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.949753Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:d61b0a644646f90ed61fdfe4eec6e76261e157900d24a428b7baf9bb2e28083b","observation_id":"07877700-cc23-492e-88f3-44e0737ecd67","resolution":{"observed_at":"2026-08-15T18:36:10.698888Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:09.953877Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.953877Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:8a4c57ad410f82b665b3dad2e51c831af2302de8ee712ade2b52dd3d37cb169e","observation_id":"bb89cd70-9005-4f4e-b7c8-f4fb6adf16d7","resolution":{"observed_at":"2026-08-15T18:36:09.953877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:09.957923Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.957923Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:e455940958ed47a385059a186831444959b6b3a0d9379356e89ba409706cc6bc","observation_id":"2019e9e5-7276-404b-b75f-dd73604e8205","resolution":{"observed_at":"2026-08-15T18:36:09.957923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:09.962086Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.962086Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:a5ce7f1812247a3c8af66c69e726181976ac7dc5a378c5af94265b03cfc580ee","observation_id":"230e036f-46c7-4b38-899d-7e57e40f4abb","resolution":{"observed_at":"2026-08-15T18:36:09.962086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.14305","last_updated":"2021-06-27T18:29:45Z","snapshot_observed_at":"2026-08-19T13:04:28.622927Z","submitted_at":"2021-06-27T18:29:45Z","title":"Unsupervised Skill Discovery with Bottleneck Option Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.14305","snapshot_observed_at":"2026-08-15T18:36:09.966611Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.966611Z"},"links":{"cited_paper":"/paper/2106.14305","citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:9b6a7775ed0179a651f887c887e0e9258c2309468d15428bbfdf7c245bf6c321","observation_id":"9ee83f53-087c-4165-ae6c-d6c456125636","resolution":{"observed_at":"2026-08-15T18:36:09.966611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:09.971472Z","title":"R.; Sobh, I.; Talpaert, V.; Mannion, P.; Al Sallab, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.971472Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:de967507b772bb493db7016d5f73bc081c721729c8fec98c5311fa64cd508d68","observation_id":"9aa2d926-e08d-4f66-9221-fc5386564f62","resolution":{"observed_at":"2026-08-15T18:36:09.971472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:09.976101Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.976101Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:e8580d67ff2bd53ddadce95de9cb6029897c1791e4845e14f6118c7068943702","observation_id":"eb26430f-f4ee-4316-98f0-eba4abc3805f","resolution":{"observed_at":"2026-08-15T18:36:09.976101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:09.979894Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.979894Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:3cd7408aef1f3a8e8fb49c56bbe468d0311ce84189e15d8db51abd9b4b809cec","observation_id":"91fedb16-cdf8-41f8-a08e-5907fee6a044","resolution":{"observed_at":"2026-08-15T18:36:09.979894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11861","last_updated":"2022-02-19T01:12:25Z","snapshot_observed_at":"2026-08-19T14:58:29.143957Z","submitted_at":"2022-01-27T23:59:56Z","title":"The Challenges of Exploration for Offline Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11861","snapshot_observed_at":"2026-08-15T18:36:09.983800Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.983800Z"},"links":{"cited_paper":"/paper/2201.11861","citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:90315f1595bbec09201dbf333c90429570a99ca145bd86604c0fbb689e1b50ab","observation_id":"d3d698d3-d6f9-4d7c-82aa-0348fb02cc16","resolution":{"observed_at":"2026-08-15T18:36:09.983800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.15191","last_updated":"2021-10-28T15:07:01Z","snapshot_observed_at":"2026-08-16T17:45:43.534665Z","submitted_at":"2021-10-28T15:07:01Z","title":"URLB: Unsupervised Reinforcement Learning Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.15191","snapshot_observed_at":"2026-08-15T18:36:09.988726Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.988726Z"},"links":{"cited_paper":"/paper/2110.15191","citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:456a568615ac569bb5d755c8234a7e75a49f7dcdf1a0f921ff69614ba905cc3b","observation_id":"0cddfca4-c02d-4cb5-a062-3788613be1bf","resolution":{"observed_at":"2026-08-15T18:36:09.988726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.05274","last_updated":"2020-02-28T16:02:59Z","snapshot_observed_at":"2026-08-14T16:16:38.304748Z","submitted_at":"2019-06-12T17:57:02Z","title":"Efficient Exploration via State Marginal Matching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.05274","snapshot_observed_at":"2026-08-15T18:36:09.992880Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.992880Z"},"links":{"cited_paper":"/paper/1906.05274","citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:696fd5ffb24815dc312c942f9e5d2fed0653701ec8f4b2db6da767ca11621fe5","observation_id":"707ed1ff-1125-476e-a122-100818fbcd2c","resolution":{"observed_at":"2026-08-15T18:36:09.992880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-15T18:36:09.996815Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:09.996815Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:6094251732b705d846b0e25b020f390a412b26a50409e66c51f5ba884a391461","observation_id":"75c653fb-ef19-46f6-8237-414fc4f98dc0","resolution":{"observed_at":"2026-08-15T18:36:09.996815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.643244Z","title":null,"venue":null,"work_id":"0ef5cd07-b5fe-4a33-a44e-d9667675e5d3","year":2021},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.001425Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:d02582b1bb4d259514a81108f9792af5ed46b1a9aa40dbce531c3880df3cb080","observation_id":"7cb90174-5b10-488b-a524-92f029729263","resolution":{"observed_at":"2026-08-15T18:36:10.647241Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.630799Z","title":null,"venue":null,"work_id":"587119f1-eccc-4adf-8aed-fc73ffb157ad","year":2021},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.006227Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:a37219c41e6d64d6df6c52dff5d53474216a44f82dce045b39e10a0a24b511ef","observation_id":"a3a45c34-711e-452b-940e-ab01376a75ba","resolution":{"observed_at":"2026-08-15T18:36:10.635401Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.03647","last_updated":"2020-06-23T16:54:09Z","snapshot_observed_at":"2026-08-15T09:46:30.948536Z","submitted_at":"2020-06-05T19:33:19Z","title":"Deployment-Efficient Reinforcement Learning via Model-Based Offline Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.03647","snapshot_observed_at":"2026-08-15T18:36:10.011195Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.011195Z"},"links":{"cited_paper":"/paper/2006.03647","citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:8cb2f1202de3dcc823dd341eb7d619e96fafd31b7a2a38fdfe5466b782c01428","observation_id":"22543678-eb38-47bc-9956-3bb099a74333","resolution":{"observed_at":"2026-08-15T18:36:10.011195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.017119Z","title":"A.; Veness, J.; Bellemare, M","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.017119Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:704f8b28ab74905f3d823f422405c43a7c577f5615c31d728de1884e7b63692c","observation_id":"14a228ee-165c-49bc-ac13-ad2af7ef416c","resolution":{"observed_at":"2026-08-15T18:36:10.017119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.611957Z","title":null,"venue":null,"work_id":"0e8426cb-dd46-48b3-8a83-bf729adec2d9","year":1997},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.023292Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:f8c3f97f3368b47ad51fa33b6a6322607509937c73090ffc06e5e340a9f2e3cb","observation_id":"6a36e20a-e035-4042-b90c-0d4c51def623","resolution":{"observed_at":"2026-08-15T18:36:10.616262Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.035779Z","title":"A.; and Darrell, T","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.035779Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:6b06bfa96213e6e102d98d482d661550d08732647df7381d0c9f7304ef262735","observation_id":"a42cf962-daa0-4ff0-882d-487eb6ae6076","resolution":{"observed_at":"2026-08-15T18:36:10.035779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.592867Z","title":null,"venue":null,"work_id":"6237cf9d-5490-4396-8733-907ada26e219","year":2019},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.041108Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:b2bb5edb95ce04f7cb79fd5c09b48335ca05feb82f30d71b079e3b74fde974b2","observation_id":"c82cbf08-763a-43aa-9024-71a918f8ffa2","resolution":{"observed_at":"2026-08-15T18:36:10.596407Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.00177","last_updated":"2019-10-07T20:23:21Z","snapshot_observed_at":"2026-08-20T03:06:00.034814Z","submitted_at":"2019-10-01T02:23:38Z","title":"Advantage-Weighted Regression: Simple and Scalable Off-Policy Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.00177","snapshot_observed_at":"2026-08-15T18:36:10.045803Z","title":"B.; Kumar, A.; Zhang, G.; and Levine, S","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.045803Z"},"links":{"cited_paper":"/paper/1910.00177","citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:f762e0a2fa5b831482d31eb099c6fd68c4c80b0e3b1056b5a43cef0675332500","observation_id":"0252b1c8-adab-474d-b2ab-860d417531b3","resolution":{"observed_at":"2026-08-15T18:36:10.045803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.581986Z","title":"P.; Vinyals, O.; Hassabis, D.; Wierstra, D.; and Blundell, C","venue":null,"work_id":"bb2c9778-3fbe-48bd-b034-e4f32569e4cc","year":2017},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.050509Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:a0867fddd649fa2b670f42bdca7f882f20602c21a083c82b8356ac5af2772ade","observation_id":"84b4bb08-0e6b-4b9c-94c3-edc4faf8c773","resolution":{"observed_at":"2026-08-15T18:36:10.585969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.570041Z","title":null,"venue":null,"work_id":"f91c516e-d2f6-49fd-bdcd-926bb6eed0db","year":2022},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.055564Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:3bc05f96c3230c035b77e28aa6534f344513d3576e83d19ba1eaa85a40e4f5b7","observation_id":"74f9397f-ab2f-4304-8c0e-f1b1be3b2eeb","resolution":{"observed_at":"2026-08-15T18:36:10.573925Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.557318Z","title":null,"venue":null,"work_id":"fa1b50ec-bd1f-43fe-bb86-50eb170a415d","year":2011},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.060370Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:e6bfaeb93270eeacc0c72240f370f01bc1748f26f48ed3b08cee0ad61d59578e","observation_id":"29ef0340-83cf-4d7a-8e8b-66cbf161ed1b","resolution":{"observed_at":"2026-08-15T18:36:10.561229Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.544250Z","title":null,"venue":null,"work_id":"1301478a-5fe4-493d-b591-845ecd5857fd","year":2020},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.066519Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:6bd8e4156ac9ce40187fed978dd9c8c7db2a51b720262623cf6a6e11f20c7b1e","observation_id":"85ee5d0d-a2a4-4c34-9c7e-f451150f4632","resolution":{"observed_at":"2026-08-15T18:36:10.548500Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.08396","last_updated":"2020-06-17T10:12:44Z","snapshot_observed_at":"2026-08-17T23:13:02.773256Z","submitted_at":"2020-02-19T19:21:08Z","title":"Keep Doing What Worked: Behavioral Modelling Priors for Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.08396","snapshot_observed_at":"2026-08-15T18:36:10.070983Z","title":"Y.; Springenberg, J","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.070983Z"},"links":{"cited_paper":"/paper/2002.08396","citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:0c97064402eba2b5a024f4a334e86466f7b519df8cdfca038aaa7703095b9d09","observation_id":"b35fdfef-078b-46e3-bb71-0ed15c4bf453","resolution":{"observed_at":"2026-08-15T18:36:10.070983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.076538Z","title":"J.; Guez, A.; Sifre, L.; Van Den Driessche, G.; Schrittwieser, J.; Antonoglou, I.; Panneershelvam, V.; Lanctot, M.; et al","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.076538Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:0fa089337d111a24aa792a413ce4077bd5489c8289601b85924cf0f905a666a4","observation_id":"dfdd1c22-a3be-42cf-8147-4afd2e4b2d4b","resolution":{"observed_at":"2026-08-15T18:36:10.076538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.081557Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.081557Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:42c0f330d93c356b35cfc95d77738422bf29299088d917e68f47d29e6608525d","observation_id":"71877b5b-f08e-4d63-a3f7-8fe7024e8eb4","resolution":{"observed_at":"2026-08-15T18:36:10.081557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.516404Z","title":null,"venue":null,"work_id":"d18b762e-22aa-4e41-8722-91d55a241e1b","year":2021},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.085978Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:2f30176699dee62470068ad697849d051342d34ed304e12c1e38ad15969b4261","observation_id":"4c44dcad-0f2e-4e84-b963-eb91fb9ba150","resolution":{"observed_at":"2026-08-15T18:36:10.520818Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.14226","last_updated":"2022-05-12T14:07:48Z","snapshot_observed_at":"2026-08-17T20:51:51.322849Z","submitted_at":"2021-07-29T17:58:04Z","title":"Learning more skills through optimistic exploration","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.14226","snapshot_observed_at":"2026-08-15T18:36:10.090471Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.090471Z"},"links":{"cited_paper":"/paper/2107.14226","citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:5db2edb796e5ff5f5bb9c0ad09f7d291d2c2082ac0543fc4a16071c8ac2e272e","observation_id":"4d12e61f-6d99-423a-83ba-441c26c88de2","resolution":{"observed_at":"2026-08-15T18:36:10.090471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.00690","last_updated":"2018-01-02T15:48:14Z","snapshot_observed_at":"2026-08-20T08:13:02.541942Z","submitted_at":"2018-01-02T15:48:14Z","title":"DeepMind Control Suite","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.00690","snapshot_observed_at":"2026-08-15T18:36:10.094539Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.094539Z"},"links":{"cited_paper":"/paper/1801.00690","citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:d9c49d88020afd75980fcdb17f5e5db0b2ff5829dcb28f4d1906d274431c2411","observation_id":"c9264219-78f5-4415-86dc-f119aa5a0721","resolution":{"observed_at":"2026-08-15T18:36:10.094539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.504827Z","title":null,"venue":null,"work_id":"b446af88-9419-4a92-9b18-b61394d67c87","year":2012},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.098794Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:bae36c620adafb2bb1650abffde5b4ec130a17070f2e3045b72a518377f829e9","observation_id":"7b0bf869-b264-4c78-9432-f3b82b8891fb","resolution":{"observed_at":"2026-08-15T18:36:10.508499Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.492427Z","title":"D.; O'Rourke, J.; and Goodman, J","venue":null,"work_id":"da29e2ba-e83d-4216-bfcc-00466279b6c5","year":2017},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.102765Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:352315344130cc531ca26373454ffba20af541d674cd89bce02ebccea8fda399","observation_id":"eda664b1-3d0d-44b9-b7d0-c8c8a066e28f","resolution":{"observed_at":"2026-08-15T18:36:10.496991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.480462Z","title":null,"venue":null,"work_id":"db10aec3-5082-48f8-b4b8-3a68307e75ef","year":2022},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.106910Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:3268f3bf0660016e4426cc56da3e80d836120f82469de115dc4ee9613f7ea024","observation_id":"13fd4c4f-ede0-44ba-b8af-f4e068f994e4","resolution":{"observed_at":"2026-08-15T18:36:10.484380Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11895","last_updated":"2020-10-22T17:32:13Z","snapshot_observed_at":"2026-08-18T10:17:39.354026Z","submitted_at":"2020-10-22T17:32:13Z","title":"What are the Statistical Limits of Offline RL with Linear Function Approximation?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11895","snapshot_observed_at":"2026-08-15T18:36:10.110785Z","title":"P.; and Kakade, S","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.110785Z"},"links":{"cited_paper":"/paper/2010.11895","citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:7aed0f0e80c9080aa1980fb8cc5052e6fa4fea8f9b7cd6c3ddcc881e99d60a2b","observation_id":"9ccfbf5e-f7da-4a7f-a51e-27b2c45395dc","resolution":{"observed_at":"2026-08-15T18:36:10.110785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.11361","last_updated":"2019-11-26T06:11:34Z","snapshot_observed_at":"2026-08-12T13:17:36.653110Z","submitted_at":"2019-11-26T06:11:34Z","title":"Behavior Regularized Offline Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.11361","snapshot_observed_at":"2026-08-15T18:36:10.115463Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.115463Z"},"links":{"cited_paper":"/paper/1911.11361","citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:47a51a8fab15884218ac7520124ef27ab3fc08f865db205b284956bf5594e027","observation_id":"33d2c28f-60de-420c-9b38-3bec0541dd30","resolution":{"observed_at":"2026-08-15T18:36:10.115463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.13425","last_updated":"2022-04-05T19:24:13Z","snapshot_observed_at":"2026-08-18T17:00:30.806909Z","submitted_at":"2022-01-31T18:39:27Z","title":"Don't Change the Algorithm, Change the Data: Exploratory Data for Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.13425","snapshot_observed_at":"2026-08-15T18:36:10.119414Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.119414Z"},"links":{"cited_paper":"/paper/2201.13425","citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:88c55195fe84243c1bde680d4e58c818d1e5ffeecae8b2b36c3bf33d8e029ccd","observation_id":"4ec831bc-f078-4f32-bfdb-156e5e9acacc","resolution":{"observed_at":"2026-08-15T18:36:10.119414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.465895Z","title":null,"venue":null,"work_id":"488accd4-5fda-49c6-abef-8da233915da6","year":2021},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.124095Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:ddbcb1531c891951c9eae56caa85ca42fb73621c9204739524b4325eb0c5e7fe","observation_id":"7f13ca4a-f512-4acb-a593-04f1d1808ade","resolution":{"observed_at":"2026-08-15T18:36:10.470748Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.453824Z","title":null,"venue":null,"work_id":"8c1a4e69-9520-428b-863a-43c1d67ad4dc","year":2020},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.127645Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:82e59f4c20e76d6be1c3660c67fd772249a1e56d1b269cad577b6e65325f6177","observation_id":"d0f403d1-6630-47d0-b962-bee756ab3138","resolution":{"observed_at":"2026-08-15T18:36:10.457970Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.440727Z","title":null,"venue":null,"work_id":"10b51de6-ff64-46a0-8360-731ebb943610","year":2020},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.131093Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:2037a00e593749c3663d8d21d5c3c127ca55805c403495a9c38761ec0d9d69ce","observation_id":"c507c783-4fad-44e6-8736-e098c03150b9","resolution":{"observed_at":"2026-08-15T18:36:10.445315Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.424076Z","title":"Y.; Levine, S.; Finn, C.; and Ma, T","venue":null,"work_id":"2d4ec97a-137e-4a42-b45d-c9bb7d3386ec","year":2020},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.134800Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:4f7d357250b4d1678e7b8804841662a932dea78310aeee34ff9f03af9fee60fb","observation_id":"78eeea07-a431-4104-9973-518451a3ca0e","resolution":{"observed_at":"2026-08-15T18:36:10.429060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.409117Z","title":null,"venue":null,"work_id":"5f7e7ec1-1001-4767-a3f1-436f79da1a8b","year":2022},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.138872Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:f49835051447276e53f560faf5a3182a6c714dec1377b0fb85915f030c4d5639","observation_id":"6787164d-ea9a-4e25-a06f-9423cff81630","resolution":{"observed_at":"2026-08-15T18:36:10.412788Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:36:10.142957Z","title":"P.; and Westerlund, T","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-15T18:36:10.142957Z"},"links":{"citing_paper":"/paper/2506.19643"},"observation_digest":"sha256:8635a7230e22adfebaae9b8daccbbd8d555e736f94d6963b7c55d1e7936e54ba","observation_id":"163dd548-5f35-4ca2-b0d8-d2c594ef1047","resolution":{"observed_at":"2026-08-15T18:36:10.142957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.19643","last_updated":"2025-06-24T14:08:36Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-19T15:26:25.045626Z","submitted_at":"2025-06-24T14:08:36Z","title":"Unsupervised Data Generation for Offline Reinforcement Learning: A Perspective from Model"},"reference_resolution":{"displayed":64,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":58,"verified_exact":1,"verified_fuzzy":5},"total_outbound_references":64},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 64 of 64 outbound references and 0 inbound Pith citation observations for arXiv:2506.19643."}