{"as_of":"2026-08-17T22:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e45bf2918bbbcdfa56bf27d95a914d4ccdebd262b60bac5fd14f7685a23cf883","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T00:51:43.997955Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.10386/citation-record","integrity":"/paper/2608.10386/integrity","json":"/paper/2608.10386/citation-record.json","paper":"/paper/2608.10386"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:51:44.487056Z","title":"Preparing a nation for autonomous vehicles: oppor- tunities, barriers and policy recommendations.Transportation Research Part A: Policy and Practice, 77:167–181, 2015","venue":null,"work_id":"157ea3b3-2a39-4a2e-974e-9f4d9496e762","year":2015},"citing_paper":{"arxiv_id":"2608.10386","last_updated":"2026-08-11T02:27:26Z","snapshot_observed_at":"2026-08-17T15:57:41.498169Z","submitted_at":"2026-08-11T02:27:26Z","title":"Dreamer-SAC: Off-Policy Learning in Latent World Models for Sample-Efficient Autonomous Driving","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T00:51:43.889694Z"},"links":{"citing_paper":"/paper/2608.10386"},"observation_digest":"sha256:c27a7d56bbaa1e69a532c954ad116b5d0ffd93bd0aad10a9004a012d54ba1d9d","observation_id":"2f2adf06-b1dc-453d-90a5-2dbb927f861c","resolution":{"observed_at":"2026-08-12T00:51:44.495045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:51:44.464478Z","title":"Virtual testing of automated driving systems: A survey on validation methods.IEEE Access, 10:40149–40169, 2022","venue":null,"work_id":"67a281db-37b2-48fc-9ac4-a88d1b6a617a","year":2022},"citing_paper":{"arxiv_id":"2608.10386","last_updated":"2026-08-11T02:27:26Z","snapshot_observed_at":"2026-08-17T15:57:41.498169Z","submitted_at":"2026-08-11T02:27:26Z","title":"Dreamer-SAC: Off-Policy Learning in Latent World Models for Sample-Efficient Autonomous Driving","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T00:51:43.896163Z"},"links":{"citing_paper":"/paper/2608.10386"},"observation_digest":"sha256:8ab263901dad37e46c25014f8ae0f137dfa5925f4b30a4ad6336d6d9b026377c","observation_id":"90b2f4b5-3eff-4d64-be58-bcb22c643603","resolution":{"observed_at":"2026-08-12T00:51:44.470304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:51:43.902014Z","title":"Deep reinforcement learning for autonomous driving: A survey","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.10386","last_updated":"2026-08-11T02:27:26Z","snapshot_observed_at":"2026-08-17T15:57:41.498169Z","submitted_at":"2026-08-11T02:27:26Z","title":"Dreamer-SAC: Off-Policy Learning in Latent World Models for Sample-Efficient Autonomous Driving","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T00:51:43.902014Z"},"links":{"citing_paper":"/paper/2608.10386"},"observation_digest":"sha256:16a9c7de309f1d0d17078630aeddba253581ec52ff5d0980e5c6b4caf7190b3d","observation_id":"7763fc11-43ec-4a27-b593-79e2a0cd67d9","resolution":{"observed_at":"2026-08-12T00:51:43.902014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:51:44.435643Z","title":null,"venue":null,"work_id":"da4ff623-ebb6-4fb4-8d58-2605f837f6fc","year":2024},"citing_paper":{"arxiv_id":"2608.10386","last_updated":"2026-08-11T02:27:26Z","snapshot_observed_at":"2026-08-17T15:57:41.498169Z","submitted_at":"2026-08-11T02:27:26Z","title":"Dreamer-SAC: Off-Policy Learning in Latent World Models for Sample-Efficient Autonomous Driving","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T00:51:43.907283Z"},"links":{"citing_paper":"/paper/2608.10386"},"observation_digest":"sha256:69f5526f318134934388971f367726e49cc73ca6807b4a110e689d0bb0d11b3f","observation_id":"a3866bd1-08dc-4e46-896d-8921cd8bb208","resolution":{"observed_at":"2026-08-12T00:51:44.440766Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11260","last_updated":"2025-09-10T14:02:23Z","snapshot_observed_at":"2026-08-16T09:13:51.664817Z","submitted_at":"2025-01-20T04:00:02Z","title":"A Survey of World Models for Autonomous Driving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11260","snapshot_observed_at":"2026-08-12T00:51:43.912861Z","title":"A survey of world models for autonomous driving","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10386","last_updated":"2026-08-11T02:27:26Z","snapshot_observed_at":"2026-08-17T15:57:41.498169Z","submitted_at":"2026-08-11T02:27:26Z","title":"Dreamer-SAC: Off-Policy Learning in Latent World Models for Sample-Efficient Autonomous Driving","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T00:51:43.912861Z"},"links":{"cited_paper":"/paper/2501.11260","citing_paper":"/paper/2608.10386"},"observation_digest":"sha256:fc323808a42fd5c6c50228e5a74f8719c2842314687a0620abf98d0346ce5f68","observation_id":"c445162c-71de-403a-a5f4-2d8e2dd98ad5","resolution":{"observed_at":"2026-08-12T00:51:43.912861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:51:44.416983Z","title":"A review of motion planning techniques for automated vehicles.IEEE Transactions on Intelligent Transportation Systems, 17(4):1135–1145, 2016","venue":null,"work_id":"88cd8213-0284-42ca-9087-2b6829cf4402","year":2016},"citing_paper":{"arxiv_id":"2608.10386","last_updated":"2026-08-11T02:27:26Z","snapshot_observed_at":"2026-08-17T15:57:41.498169Z","submitted_at":"2026-08-11T02:27:26Z","title":"Dreamer-SAC: Off-Policy Learning in Latent World Models for Sample-Efficient Autonomous Driving","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T00:51:43.918400Z"},"links":{"citing_paper":"/paper/2608.10386"},"observation_digest":"sha256:d4dfe4657dacc51c226c07700f9cd1f3a4ea1d467b3856b2c569cfee48cf1c91","observation_id":"ad5d9268-3887-4219-afbf-c268827597f9","resolution":{"observed_at":"2026-08-12T00:51:44.423135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:51:44.396542Z","title":"Planning and decision-making for autonomous vehicles.Annual Review of Control, Robotics, and Autonomous Systems, 1: 187–210, 2018","venue":null,"work_id":"a023561c-d308-444f-b853-52dd570eaa31","year":2018},"citing_paper":{"arxiv_id":"2608.10386","last_updated":"2026-08-11T02:27:26Z","snapshot_observed_at":"2026-08-17T15:57:41.498169Z","submitted_at":"2026-08-11T02:27:26Z","title":"Dreamer-SAC: Off-Policy Learning in Latent World Models for Sample-Efficient Autonomous Driving","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T00:51:43.924102Z"},"links":{"citing_paper":"/paper/2608.10386"},"observation_digest":"sha256:84237d1627cfb280400e4359458dedb649cb144b14eb48154f4aa25eba419812","observation_id":"a1045b66-7549-40aa-bb39-00d6fa5889cd","resolution":{"observed_at":"2026-08-12T00:51:44.402621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:51:44.376984Z","title":"Predictive active steering control for autonomous vehicle systems.IEEE Transactions on Control Systems Technology, 15(3):566–580, 2007","venue":null,"work_id":"59beace2-8dcb-4f7e-a47c-a71d61657d24","year":2007},"citing_paper":{"arxiv_id":"2608.10386","last_updated":"2026-08-11T02:27:26Z","snapshot_observed_at":"2026-08-17T15:57:41.498169Z","submitted_at":"2026-08-11T02:27:26Z","title":"Dreamer-SAC: Off-Policy Learning in Latent World Models for Sample-Efficient Autonomous Driving","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T00:51:43.929174Z"},"links":{"citing_paper":"/paper/2608.10386"},"observation_digest":"sha256:c061834f9dc40103186468ed802af6b25c0e2c71c440b1ccf267dcd353e75ecc","observation_id":"1fc72c53-2e08-4204-9fca-7aa4ed6910de","resolution":{"observed_at":"2026-08-12T00:51:44.383648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:51:44.356683Z","title":"A survey on imitation learning techniques for end-to-end autonomous vehicles.IEEE Transactions on Intelligent Transportation Systems, 23(9):14128–14147, 2022","venue":null,"work_id":"c52807ea-ba20-41fa-8534-22759eb3610f","year":2022},"citing_paper":{"arxiv_id":"2608.10386","last_updated":"2026-08-11T02:27:26Z","snapshot_observed_at":"2026-08-17T15:57:41.498169Z","submitted_at":"2026-08-11T02:27:26Z","title":"Dreamer-SAC: Off-Policy Learning in Latent World Models for Sample-Efficient Autonomous Driving","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T00:51:43.934185Z"},"links":{"citing_paper":"/paper/2608.10386"},"observation_digest":"sha256:cb1f93a336e594eb04201ef8b3bbfe9bd3b9e547cd93e38e939f4d9dc0017500","observation_id":"725417a8-c345-48dd-af70-c8dbe7afa8e8","resolution":{"observed_at":"2026-08-12T00:51:44.362434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:51:44.341043Z","title":"End-to-end driving via conditional imitation learning","venue":null,"work_id":"886521dd-bb03-40e0-9bae-1273f8d2dd90","year":2018},"citing_paper":{"arxiv_id":"2608.10386","last_updated":"2026-08-11T02:27:26Z","snapshot_observed_at":"2026-08-17T15:57:41.498169Z","submitted_at":"2026-08-11T02:27:26Z","title":"Dreamer-SAC: Off-Policy Learning in Latent World Models for Sample-Efficient Autonomous Driving","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T00:51:43.939176Z"},"links":{"citing_paper":"/paper/2608.10386"},"observation_digest":"sha256:a261b53c0a752c54e50522bc6c9069aafa28d41b1db04cfc8612aaf6116ff7e8","observation_id":"f997ac2b-a689-4013-9032-debe5912fe3d","resolution":{"observed_at":"2026-08-12T00:51:44.346179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-12T00:51:43.945373Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.10386","last_updated":"2026-08-11T02:27:26Z","snapshot_observed_at":"2026-08-17T15:57:41.498169Z","submitted_at":"2026-08-11T02:27:26Z","title":"Dreamer-SAC: Off-Policy Learning in Latent World Models for Sample-Efficient Autonomous Driving","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T00:51:43.945373Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2608.10386"},"observation_digest":"sha256:41992d0cd0275884b9b394a5ed0bea65fefc4bb0b651fcf847edb6a89b2d6ef3","observation_id":"0341e64c-cc2e-465b-897d-4018182258d6","resolution":{"observed_at":"2026-08-12T00:51:43.945373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:51:44.323810Z","title":"Soft actor-critic: Off- policy maximum entropy deep reinforcement learning with a stochastic actor","venue":null,"work_id":"67417ce5-f584-4b85-aa27-f001d82ebc20","year":2018},"citing_paper":{"arxiv_id":"2608.10386","last_updated":"2026-08-11T02:27:26Z","snapshot_observed_at":"2026-08-17T15:57:41.498169Z","submitted_at":"2026-08-11T02:27:26Z","title":"Dreamer-SAC: Off-Policy Learning in Latent World Models for Sample-Efficient Autonomous Driving","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T00:51:43.950233Z"},"links":{"citing_paper":"/paper/2608.10386"},"observation_digest":"sha256:a63341f036da47d464af7a9d036a36f1423ade70fdef55bb2e8c77e73774f658","observation_id":"ca449485-8d8d-4087-be9f-ec125c8d590a","resolution":{"observed_at":"2026-08-12T00:51:44.329334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:51:43.955391Z","title":"When to trust your model: Model-based policy optimization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.10386","last_updated":"2026-08-11T02:27:26Z","snapshot_observed_at":"2026-08-17T15:57:41.498169Z","submitted_at":"2026-08-11T02:27:26Z","title":"Dreamer-SAC: Off-Policy Learning in Latent World Models for Sample-Efficient Autonomous Driving","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T00:51:43.955391Z"},"links":{"citing_paper":"/paper/2608.10386"},"observation_digest":"sha256:1bf6d9efa2127821e1a97f539a89b7478f0e792eb34123def5991db011c5e2e3","observation_id":"90c97f47-741e-4bb0-9d37-a2fbe2f11ef1","resolution":{"observed_at":"2026-08-12T00:51:43.955391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:51:44.292910Z","title":"Learning latent dynamics for planning from pixels","venue":null,"work_id":"cdd910ca-212a-43ea-ad25-03e39bd41505","year":2019},"citing_paper":{"arxiv_id":"2608.10386","last_updated":"2026-08-11T02:27:26Z","snapshot_observed_at":"2026-08-17T15:57:41.498169Z","submitted_at":"2026-08-11T02:27:26Z","title":"Dreamer-SAC: Off-Policy Learning in Latent World Models for Sample-Efficient Autonomous Driving","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T00:51:43.960475Z"},"links":{"citing_paper":"/paper/2608.10386"},"observation_digest":"sha256:ec67910e4761d60139c89e4807f678e9d42ac9e90dc5843b1f4a9b0f79417130","observation_id":"92012f6e-7caf-4a9e-a427-9022fc0b7bb7","resolution":{"observed_at":"2026-08-12T00:51:44.298474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01603","last_updated":"2020-03-17T17:10:58Z","snapshot_observed_at":"2026-08-15T17:22:37.525122Z","submitted_at":"2019-12-03T18:57:16Z","title":"Dream to Control: Learning Behaviors by Latent Imagination","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01603","snapshot_observed_at":"2026-08-12T00:51:43.965965Z","title":"Dream to control: Learning behaviors by latent imagination.arXiv preprint arXiv:1912.01603, 2019","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2608.10386","last_updated":"2026-08-11T02:27:26Z","snapshot_observed_at":"2026-08-17T15:57:41.498169Z","submitted_at":"2026-08-11T02:27:26Z","title":"Dreamer-SAC: Off-Policy Learning in Latent World Models for Sample-Efficient Autonomous Driving","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T00:51:43.965965Z"},"links":{"cited_paper":"/paper/1912.01603","citing_paper":"/paper/2608.10386"},"observation_digest":"sha256:008dbbb78f02aab474484e3b26be904635407066e3fb3f9d0fef055a0b310af9","observation_id":"681afd05-ff94-436d-a7dc-7dcf4afb2519","resolution":{"observed_at":"2026-08-12T00:51:43.965965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:51:44.272860Z","title":"Mastering diverse control tasks through world models.Nature, 640(8059):647–653, 2025","venue":null,"work_id":"457c2882-dde9-4815-8e83-4400b238ca8b","year":2025},"citing_paper":{"arxiv_id":"2608.10386","last_updated":"2026-08-11T02:27:26Z","snapshot_observed_at":"2026-08-17T15:57:41.498169Z","submitted_at":"2026-08-11T02:27:26Z","title":"Dreamer-SAC: Off-Policy Learning in Latent World Models for Sample-Efficient Autonomous Driving","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T00:51:43.971769Z"},"links":{"citing_paper":"/paper/2608.10386"},"observation_digest":"sha256:c92e408a84c88f306e9908d4b8eedfb84d2a9131f8f14712188e433bdbe72b96","observation_id":"c1b95e7f-8668-471f-9141-06c311cd6a7f","resolution":{"observed_at":"2026-08-12T00:51:44.279815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:51:44.252511Z","title":null,"venue":null,"work_id":"80e3645c-f50b-4e88-b833-e0081f67f858","year":2024},"citing_paper":{"arxiv_id":"2608.10386","last_updated":"2026-08-11T02:27:26Z","snapshot_observed_at":"2026-08-17T15:57:41.498169Z","submitted_at":"2026-08-11T02:27:26Z","title":"Dreamer-SAC: Off-Policy Learning in Latent World Models for Sample-Efficient Autonomous Driving","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T00:51:43.976184Z"},"links":{"citing_paper":"/paper/2608.10386"},"observation_digest":"sha256:55bf1048117bd532f2993863b3161cdd08c1a3a5c79ffb9c928e7cb6e7fb25d6","observation_id":"c7c66ac9-dee1-4f50-9bb5-adedfca7af68","resolution":{"observed_at":"2026-08-12T00:51:44.257881Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:51:43.980667Z","title":"Raw2drive: Reinforcement learning with aligned world models for end-to-end autonomous driving (in carla v2).arXiv preprint arXiv:2505.16394, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10386","last_updated":"2026-08-11T02:27:26Z","snapshot_observed_at":"2026-08-17T15:57:41.498169Z","submitted_at":"2026-08-11T02:27:26Z","title":"Dreamer-SAC: Off-Policy Learning in Latent World Models for Sample-Efficient Autonomous Driving","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T00:51:43.980667Z"},"links":{"citing_paper":"/paper/2608.10386"},"observation_digest":"sha256:f9e1c5cf5d9905ef646a1ade10787fa01037faf904bdb1b2c80c83f8ca99c999","observation_id":"91d65c51-0f51-44ae-b69e-ef8e63ccace0","resolution":{"observed_at":"2026-08-12T00:51:43.980667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.06036","last_updated":"2021-03-04T20:04:50Z","snapshot_observed_at":"2026-08-17T19:54:46.448667Z","submitted_at":"2020-08-13T17:49:18Z","title":"Reinforcement Learning with Trajectory Feedback","version":2},"cited_work":{"arxiv_id":"2008.06036","doi":null,"metadata_source":"pith","pith_arxiv_id":"2008.06036","snapshot_observed_at":"2026-08-12T00:51:44.040745Z","title":"Reinforcement Learning with Trajectory Feedback","venue":"cs.LG","work_id":"efb6bbb6-27de-475f-8372-e37d55726e84","year":2020},"citing_paper":{"arxiv_id":"2608.10386","last_updated":"2026-08-11T02:27:26Z","snapshot_observed_at":"2026-08-17T15:57:41.498169Z","submitted_at":"2026-08-11T02:27:26Z","title":"Dreamer-SAC: Off-Policy Learning in Latent World Models for Sample-Efficient Autonomous Driving","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T00:51:43.986018Z"},"links":{"cited_paper":"/paper/2008.06036","citing_paper":"/paper/2608.10386"},"observation_digest":"sha256:bb4d70012b206427ac1ab2f7bdcaf2975f71a9d35affdfc8fa0cd1a36d042fc2","observation_id":"eef7fdc5-3f66-4db4-b463-695e85b0756c","resolution":{"observed_at":"2026-08-12T00:51:44.049063Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:51:44.235266Z","title":"Planning and acting in partially observable stochastic domains.Artificial Intelligence, 101(1-2):99–134, 1998","venue":null,"work_id":"3d05dad2-d9b7-42c0-83a9-35573ccbdd3e","year":1998},"citing_paper":{"arxiv_id":"2608.10386","last_updated":"2026-08-11T02:27:26Z","snapshot_observed_at":"2026-08-17T15:57:41.498169Z","submitted_at":"2026-08-11T02:27:26Z","title":"Dreamer-SAC: Off-Policy Learning in Latent World Models for Sample-Efficient Autonomous Driving","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T00:51:43.992444Z"},"links":{"citing_paper":"/paper/2608.10386"},"observation_digest":"sha256:325de4d01c1a5976dd5786a3c84c50a8b74ae23b0ad65db7b83fa151774c063b","observation_id":"59660f36-5aee-4fe9-96e2-b52b20fa0fa9","resolution":{"observed_at":"2026-08-12T00:51:44.240955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:51:44.218874Z","title":"Metadrive: Composing diverse driving scenarios for generalizable reinforcement learning","venue":null,"work_id":"da966108-dcbd-47f7-ab6a-622f7752d69b","year":2022},"citing_paper":{"arxiv_id":"2608.10386","last_updated":"2026-08-11T02:27:26Z","snapshot_observed_at":"2026-08-17T15:57:41.498169Z","submitted_at":"2026-08-11T02:27:26Z","title":"Dreamer-SAC: Off-Policy Learning in Latent World Models for Sample-Efficient Autonomous Driving","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T00:51:43.997955Z"},"links":{"citing_paper":"/paper/2608.10386"},"observation_digest":"sha256:dd094cc29e3251b7cb80a86211c1fbde74798f7805602e1dd659878bfcc46059","observation_id":"79998f78-6f0f-4229-8e19-b68f27bbcc2f","resolution":{"observed_at":"2026-08-12T00:51:44.224014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.10386","last_updated":"2026-08-11T02:27:26Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T15:57:41.498169Z","submitted_at":"2026-08-11T02:27:26Z","title":"Dreamer-SAC: Off-Policy Learning in Latent World Models for Sample-Efficient Autonomous Driving"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":1,"verified_fuzzy":12},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2608.10386."}