{"as_of":"2026-08-18T23:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8e0c8488d66afd476ba3ba4e58182c11a62dca8af8b6b2df0cd293c34583b962","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T14:48:49.451638Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T06:00:50.589688Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T06:00:50.794346Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2501.14992","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.14992","snapshot_observed_at":"2026-08-05T06:00:50.794346Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","venue":"cs.LG","work_id":"80c0abb1-b8c4-490c-a9cc-65107a91bee3","year":2025},"citing_paper":{"arxiv_id":"2509.04712","last_updated":"2025-09-04T23:56:26Z","snapshot_observed_at":"2026-08-18T01:55:10.785756Z","submitted_at":"2025-09-04T23:56:26Z","title":"Bootstrapping Reinforcement Learning with Sub-optimal Policies for Autonomous Driving","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T06:00:50.589688Z"},"links":{"cited_paper":"/paper/2501.14992","citing_paper":"/paper/2509.04712"},"observation_digest":"sha256:c8a1660becff1de40062c6e055942b9405b793e441a2c44a12ccc47ef950c387","observation_id":"c6c14dc3-1631-44ad-a571-876a55ac214f","resolution":{"observed_at":"2026-08-05T06:00:50.800160Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.14992/citation-record","integrity":"/paper/2501.14992/integrity","json":"/paper/2501.14992/citation-record.json","paper":"/paper/2501.14992"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:50.115546Z","title":"Deep reinforcement learning for autonomous driving: A survey","venue":null,"work_id":"3aae68cc-b7c2-47e1-94cb-2f50c186409b","year":2021},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.254642Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:a932c6658d1d30b1f82f156cb0ec1098e6ae46806aeb6ae6c3d932e8807a0ad1","observation_id":"6c36f36f-e6a6-45f2-8f06-0828867163f2","resolution":{"observed_at":"2026-08-10T14:48:50.120790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.260753Z","title":"A survey of autonomous driving: Common practices and emerging technologies","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.260753Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:a81a1e6f0185d40ea0fde00aa52b4660d0e882c197380af4a562bbac46fc1867","observation_id":"012a6269-2b02-4b23-bd92-a6b361f32b9a","resolution":{"observed_at":"2026-08-10T14:48:49.260753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:50.087159Z","title":"Evaluating the utility of driving: Toward automated decision making under uncertainty","venue":null,"work_id":"9f5a243d-29e6-4f59-bc27-fec77cd0c7b7","year":2011},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.265985Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:72b601e6d5cfa8f99aa8d32b1f59b770743f21d6f15cad7073e8be08a06740ea","observation_id":"ecef3ed7-6687-487a-a411-46f4feb621f2","resolution":{"observed_at":"2026-08-10T14:48:50.092344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:50.070791Z","title":"Sketch of an ivhs systems architecture","venue":null,"work_id":"8b1ba1f5-9cb1-4edd-8cd3-c694ab559e27","year":1991},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.271658Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:876306bf9c882850838e5e9d3f70f9753474ceb511c577f9ffea9e2a7df8547e","observation_id":"36361f9b-bf0e-4c50-b096-ff411623ffd2","resolution":{"observed_at":"2026-08-10T14:48:50.075991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:50.053527Z","title":"A multiple- goal reinforcement learning method for complex vehicle overtak- ing maneuvers","venue":null,"work_id":"a4e54630-021c-4b66-93c8-17ee41f9933e","year":2011},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.277438Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:cc0ee40218dd095f4989dc5e77038498c6f495fcfd56f1e1020b80bcab9ac11d","observation_id":"a9347bb9-0900-4d4e-aba8-ae8060171d10","resolution":{"observed_at":"2026-08-10T14:48:50.058823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.283117Z","title":"A reinforcement learning approach to autonomous decision making of intelligent vehicles on highways","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.283117Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:f6792866e5e5bbbf33a1b1cf465626b72d6090b38f3c1cd378c1d0f9d6fa01b6","observation_id":"04e4a632-13f3-4c73-88ee-74cf51fc37dc","resolution":{"observed_at":"2026-08-10T14:48:49.283117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:50.023015Z","title":"A review and analysis of lit- erature on autonomous driving","venue":null,"work_id":"fbca9f14-f167-4b58-b280-840ae1b4bc4b","year":2015},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.289005Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:9096252e707e2f3f3f19c3a1dd616753c6489d835808f1322af9622b5748a114","observation_id":"44849914-9259-4c26-82fa-c10996b29324","resolution":{"observed_at":"2026-08-10T14:48:50.028392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:50.004208Z","title":"An integrated model for autonomous speed and lane change decision- making based on deep reinforcement learning","venue":null,"work_id":"f42f53b1-ebd6-4502-864f-5fb4f0110729","year":2022},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.294399Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:6a1090ac2d89d749466f3bf73301d736632dc25e0843bfc3b42c37980a6af288","observation_id":"52d97b39-787a-4222-bdd1-598705cdf50c","resolution":{"observed_at":"2026-08-10T14:48:50.011741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.985989Z","title":"Lane change and merge maneuvers for connected and automated vehicles: A survey.IEEE Transactions on Intelligent Vehicles, 1(1):105–120, 2016","venue":null,"work_id":"5fc735e5-f557-4215-bf8a-8045fc4c8b8a","year":2016},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.299685Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:fc05824408b0dc6b5e7f27641466f70f36f70fb713c13602ea2876acfc764546","observation_id":"ed3546da-55ed-4c67-8a0a-6276f480c84c","resolution":{"observed_at":"2026-08-10T14:48:49.991397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.967652Z","title":"Automated lane change controller design","venue":null,"work_id":"48e7252a-47bd-495b-b65c-533e2085d385","year":2003},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.305155Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:a3000d71f233e5dd82e3fd1a47eebc191729f4d1ac8104b92a4676ab7db359d9","observation_id":"b4bae2f5-f462-4a92-a80a-c1cede241f80","resolution":{"observed_at":"2026-08-10T14:48:49.974542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.949750Z","title":"Traffic dynamics: studies in car following","venue":null,"work_id":"40beb62f-01e8-4f36-9110-4275957fe540","year":1958},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.310474Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:e5ff358ddde8f98f3c17916412e5fae934c37de2436615f19249a2b971d49abf","observation_id":"32684c30-4594-4336-b349-d7ef0c1488a6","resolution":{"observed_at":"2026-08-10T14:48:49.955472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.934014Z","title":"A behavioural car-following model for computer simulation","venue":null,"work_id":"874fc398-da21-4e6e-9bf7-4f06cdaab506","year":1981},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.315934Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:25084f64ded56cac4f516594ceaf0f968a10f91784efe242eb5655e9058e4e33","observation_id":"d08fb8de-fd77-45ff-a982-360e6d164f87","resolution":{"observed_at":"2026-08-10T14:48:49.938674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.917694Z","title":"Congested traffic states in empirical observations and microscopic simula- tions","venue":null,"work_id":"3def5cb2-d1b0-413f-8a9e-9a0bbae868f9","year":2000},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.320995Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:3567162c6a1742483e79aca03b1edc03ef234ceaac97ef374c21fafea4eb5dcd","observation_id":"b0c5240f-3d0c-4963-b246-ee5a599ebcc3","resolution":{"observed_at":"2026-08-10T14:48:49.923215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.899559Z","title":"General lane- changing model mobil for car-following models","venue":null,"work_id":"84f7f074-f7f3-4c87-9b85-4ef29c4f52ce","year":1999},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.327013Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:40815c94f761b5f2dcbb1ece23bacf95fb8f2c7fdd5f2e1e828c790352c075ae","observation_id":"b9ff7b56-9f0a-471c-8fb1-2d1988c3eeed","resolution":{"observed_at":"2026-08-10T14:48:49.906388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.882785Z","title":"Driving intention recognition and lane change prediction on the highway","venue":null,"work_id":"e3b2f753-4c76-4fde-8f00-282cec06bfc8","year":2019},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.332589Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:83327a8df969fc33d669e15b0fc07ae25c32dbfc0a2274b13d4ecbdc5e83a552","observation_id":"c29f9d66-4ae7-447f-ab94-ad61d206316f","resolution":{"observed_at":"2026-08-10T14:48:49.888018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1604.07316","last_updated":"2016-04-25T16:03:56Z","snapshot_observed_at":"2026-07-06T04:53:59.754200Z","submitted_at":"2016-04-25T16:03:56Z","title":"End to End Learning for Self-Driving Cars","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1604.07316","snapshot_observed_at":"2026-08-10T14:48:49.337924Z","title":"End to end learning for self-driving cars","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.337924Z"},"links":{"cited_paper":"/paper/1604.07316","citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:3cf37b5cb877d26f478c3d368378decfc44d52cfddfdf830f3d7a97c69adb9ef","observation_id":"5c5b652c-49a8-49e0-a351-1bdcf38b8710","resolution":{"observed_at":"2026-08-10T14:48:49.337924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.07911","last_updated":"2017-04-25T21:25:41Z","snapshot_observed_at":"2026-08-16T01:14:39.628559Z","submitted_at":"2017-04-25T21:25:41Z","title":"Explaining How a Deep Neural Network Trained with End-to-End Learning Steers a Car","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.07911","snapshot_observed_at":"2026-08-10T14:48:49.343845Z","title":"Explaining how a deep neural network trained with end-to-end learning steers a car","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.343845Z"},"links":{"cited_paper":"/paper/1704.07911","citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:36b98ee3bd10ff39223a9da22ccef62b542d5c1517747837dcfb062aa44eb77e","observation_id":"a74100c7-79f5-45d0-a3bc-b489ac7a8da3","resolution":{"observed_at":"2026-08-10T14:48:49.343845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.349618Z","title":"End-to-end driving via condi- tional imitation learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.349618Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:c56d9311a45772cf4a85d1f279049fd4d7cb4f2caf1dfebab8ca69eaf76830d7","observation_id":"a8c4d7b8-e31d-416a-b0d8-e5db55030171","resolution":{"observed_at":"2026-08-10T14:48:49.349618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.852666Z","title":"Urban driving with conditional imitation learning","venue":null,"work_id":"5a855441-238e-4de4-bbec-e03033485dfc","year":2020},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.355296Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:b6e65af29b760bf701a7fe51d6ebe220ae7b311f8490966df00059a96fbe7cbf","observation_id":"88d84d90-8650-4039-b7f3-cd66d77ac532","resolution":{"observed_at":"2026-08-10T14:48:49.858064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.835867Z","title":"Integrating deep reinforcement learning with model-based path planners for automated driving","venue":null,"work_id":"346f918d-e0ab-415d-9e66-24c28bcd273a","year":2020},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.360771Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:99232db0039041b69e0dbe1cdfa3977e51fd85dea1aee6ce0c2dcdad7e482e39","observation_id":"0cafb719-1b87-4cc0-aaab-1949abc10026","resolution":{"observed_at":"2026-08-10T14:48:49.841693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.819702Z","title":"Learning to drive in a day","venue":null,"work_id":"1b56f5eb-8d59-409f-bd22-111b40050e8f","year":2019},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.366510Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:6440d7c542e76e0d9665db97a6ca332654a539e212a144a6f1fb4800e07de872","observation_id":"eb3f02ea-f652-478c-8281-bfcd13eeb3d7","resolution":{"observed_at":"2026-08-10T14:48:49.824731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.803618Z","title":"Deep hierarchical reinforcement learning for autonomous driving with distinct behaviors","venue":null,"work_id":"93e20248-495b-42ce-93fa-7cd165d9123e","year":2018},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.371420Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:45cdc95506153b5a9542c145d1e52c9ca29ff3be072b610c30497d5238932941","observation_id":"2d6cc76c-fdb4-42e8-95a6-066098e67a77","resolution":{"observed_at":"2026-08-10T14:48:49.808463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.786251Z","title":"Exploiting hierarchy for scalable decision making in autonomous driving","venue":null,"work_id":"1c4ff10e-9fa0-4a05-9faa-9d3d01547166","year":2018},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.375671Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:89a5d3a90109b0a90079922c5228d8ea4ecd59fb24b0def77b0d3ee23c27c570","observation_id":"b0aac2ed-1cc8-4deb-b2aa-edea408407a8","resolution":{"observed_at":"2026-08-10T14:48:49.791941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.770290Z","title":"Hierarchical finite state machines for autonomous mobile systems","venue":null,"work_id":"87424f72-18f0-46d0-908f-7f8d88ba4363","year":2013},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.380018Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:af60de05ef24b105ed5f1499dfaf4d79ee8485079e217fa72101998cdf928c65","observation_id":"78ebff57-1472-4391-87f8-fbf360d66949","resolution":{"observed_at":"2026-08-10T14:48:49.775321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.752473Z","title":"Multi-lane cruising using hierarchical planning and reinforcement learning","venue":null,"work_id":"0cd982a4-7e89-452a-94ef-35596cc2a757","year":2019},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.384238Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:052712ad2fb2a4b85549c8bab6c76139257715500aa29b7118a69a907c5f10b9","observation_id":"eed51148-1b20-41d9-9796-d8e0102b5534","resolution":{"observed_at":"2026-08-10T14:48:49.758354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.735806Z","title":"A reinforcement learning based approach for automated lane change maneuvers","venue":null,"work_id":"9985b8de-a190-44aa-bc84-9e725af5b8fc","year":2018},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.388960Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:cc4214c7bc8afcc3b9a205ef47aea98e44d3b742a08a021bc2f1ac08aa3e9c02","observation_id":"204f22f8-3fbf-479b-b17e-b44cd416cb6a","resolution":{"observed_at":"2026-08-10T14:48:49.740471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.716584Z","title":"Learning hierarchical behavior and motion planning for autonomous driving","venue":null,"work_id":"d089abd9-89eb-4483-8461-333edddf5e83","year":2020},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.393643Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:38952da611213895f08c9b4b517409f669beaa7a5a95ad100e3586b82927087f","observation_id":"5cdecd08-a3d4-431d-89e8-e71f7bf6904d","resolution":{"observed_at":"2026-08-10T14:48:49.723355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.08464","last_updated":"2019-06-20T07:05:20Z","snapshot_observed_at":"2026-07-31T19:39:39.596005Z","submitted_at":"2019-06-20T07:05:20Z","title":"A Hierarchical Architecture for Sequential Decision-Making in Autonomous Driving using Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.08464","snapshot_observed_at":"2026-08-10T14:48:49.397966Z","title":"A hierarchi- cal architecture for sequential decision-making in autonomous driving using deep reinforcement learning","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.397966Z"},"links":{"cited_paper":"/paper/1906.08464","citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:ac1434c5a5e6c01e61b01a5bec274e75a31ede47cbd742155e134ccf0f0043fd","observation_id":"ab3b37d8-a347-4283-8226-5f2d9a2b97e7","resolution":{"observed_at":"2026-08-10T14:48:49.397966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.698250Z","title":"Interpretable goal-based prediction and planning for au- tonomous driving","venue":null,"work_id":"09c32004-0556-44fa-b6c4-793fc43c2235","year":2021},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.402867Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:3135dd14951f0319bc861f3308065208e2ebac5619a69a4024ea1cd8656fd227","observation_id":"08368169-16b8-47eb-8f47-07ca7e5963c6","resolution":{"observed_at":"2026-08-10T14:48:49.704143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.680661Z","title":"Driving decision and control for automated lane change behavior based on deep reinforcement learning","venue":null,"work_id":"69b9e3b5-cd28-4962-aa40-cad25f7ca57f","year":2019},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.407170Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:c03cca3a4896b8dcbcf562f993f587ea9d30dfdb2849a2976b597bf52ad22081","observation_id":"8ba6d75a-de90-47bf-b609-5a460bd7bc36","resolution":{"observed_at":"2026-08-10T14:48:49.685959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.663554Z","title":"Hierarchical deep reinforcement learning: Integrat- ing temporal abstraction and intrinsic motivation","venue":null,"work_id":"d644c6a8-819c-495a-83a4-f80d6b8fda46","year":2016},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.411311Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:ff5eff78b1824d1d1cf78b7bdbbcbf480a3cbab977b49727185002c8efe9df97","observation_id":"8a75e899-1628-491c-acad-a88fadb34958","resolution":{"observed_at":"2026-08-10T14:48:49.668814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.416449Z","title":"Reinforcement learning: An introduction","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.416449Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:7ef03fd150a5aef26071d30c9d32c0a6eff151996b409878511805866123f31b","observation_id":"4cc43d8a-a6ec-48b9-8c6a-f1697171ecaf","resolution":{"observed_at":"2026-08-10T14:48:49.416449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.633164Z","title":"Au- tonomous highway driving using deep reinforcement learning","venue":null,"work_id":"e3b327f4-1115-45cc-9e5c-0404e049820c","year":2019},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.421447Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:addacbc6f8f89fc49581aad64157ed5328ec92db42c1c99ba8ea5f8bc35e92b0","observation_id":"6b3ccca4-4c13-48b5-a2f7-cba96ff1da6d","resolution":{"observed_at":"2026-08-10T14:48:49.639280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.426957Z","title":"Deep reinforcement learning with double q-learning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.426957Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:b6366e2ce852e72d51c8836829e908ee197b8b13b0b28f3722228f864245a505","observation_id":"b2a5bb65-390c-45e2-9520-55d5c5787573","resolution":{"observed_at":"2026-08-10T14:48:49.426957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.603434Z","title":"Human- level control through deep reinforcement learning","venue":null,"work_id":"101e61ec-6834-4caf-8eb7-d373514ca1a5","year":2015},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.432112Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:c8ce1387ad25d23b49172a10bd6e9129bd8c80c5238c75e5cd2103f4448f3b36","observation_id":"c4601e4c-ba70-4b32-beaf-bad818ecc699","resolution":{"observed_at":"2026-08-10T14:48:49.608720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.585324Z","title":"Intrinsic motivation and reinforcement learning","venue":null,"work_id":"0601928b-1753-4b9f-ae14-ae3e154eea03","year":2013},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.437270Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:efd0b378f8471d071ed0dd2e7da2174ab0e3d131b43e86fdd4b8eaafccd2f1b4","observation_id":"e842a212-ec83-4bb8-ad4c-0659e3cf1136","resolution":{"observed_at":"2026-08-10T14:48:49.590652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.442235Z","title":"An environment for autonomous driving decision-making","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.442235Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:313a048c6f8bc1460e3be70a22d73e916fa5bda3ffc85a966002aa0b8d302f94","observation_id":"dd64c0e2-3b71-4359-b68f-e2428bbe9bb1","resolution":{"observed_at":"2026-08-10T14:48:49.442235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.446889Z","title":"Decision transformer: Reinforcement learning via sequence modeling","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.446889Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:5021fa9f7899a966ee686da8881b460fa958319cd45cd6ee0822bcf6d9d28e29","observation_id":"b5d6e5f0-7db6-4e69-9618-2cd3c883ed20","resolution":{"observed_at":"2026-08-10T14:48:49.446889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:48:49.541023Z","title":"Offline reinforce- ment learning as one big sequence modeling problem","venue":null,"work_id":"b5fb90f8-4bc4-4951-9566-6295a47f561e","year":2021},"citing_paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T14:48:49.451638Z"},"links":{"citing_paper":"/paper/2501.14992"},"observation_digest":"sha256:6438efddee8a5473eba5dc91ef7c58803c4f47d3abb718150bcaadfb4a7b2528","observation_id":"c2b840cc-9ee5-4185-a7f2-ae660d85827e","resolution":{"observed_at":"2026-08-10T14:48:49.549900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.14992","last_updated":"2025-01-25T00:00:11Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T01:15:23.641898Z","submitted_at":"2025-01-25T00:00:11Z","title":"Extensive Exploration in Complex Traffic Scenarios using Hierarchical Reinforcement Learning"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":29},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 1 inbound Pith citation observation for arXiv:2501.14992."}