{"as_of":"2026-08-08T21:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6ba5675d2dbad5d43cfaed3a8560cabc3678538ef1fdb1a1ec6e6212f4bcfeed","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:49:14.797853Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.16336/citation-record","integrity":"/paper/2506.16336/integrity","json":"/paper/2506.16336/citation-record.json","paper":"/paper/2506.16336"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.13144","last_updated":"2024-09-20T01:17:54Z","snapshot_observed_at":"2026-08-08T21:47:33.792998Z","submitted_at":"2024-09-20T01:17:54Z","title":"Autonomous Driving at Unsignalized Intersections: A Review of Decision-Making Challenges and Reinforcement Learning-Based Solutions","version":1},"cited_work":{"arxiv_id":"2409.13144","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.13144","snapshot_observed_at":"2026-08-06T23:49:16.693307Z","title":"Autonomous Driving at Unsignalized Intersections: A Review of Decision-Making Challenges and Reinforcement Learning-Based Solutions","venue":"cs.RO","work_id":"1adff50c-c8fb-4044-89ce-8e7b7c592847","year":2024},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:09.979709Z"},"links":{"cited_paper":"/paper/2409.13144","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:d30ed1cc8a090f203717b0503502e4a27b469053f7a5d681833b9b0d005aeb01","observation_id":"117b6a38-8987-42aa-815d-6ed68ac816d6","resolution":{"observed_at":"2026-08-06T23:49:16.855488Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2010.0084","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:16.452324Z","title":"Enhanced intelligent driver model to access the impact of driving strategies on traffic capacity,","venue":null,"work_id":"57e6ec41-6625-4510-9da2-6db23ed9f56a","year":1928},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:10.045389Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:48baeab49ad2145df7d33b10b91baefb2af4a33d3f5e32f92f074ca8446abfd2","observation_id":"0ee6d5c9-79b8-4efb-9c2a-ac0ea1a8ea53","resolution":{"observed_at":"2026-08-06T23:49:16.567981Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:19.387665Z","title":"Extended safety descriptor measurements for relative safety assessment in mixed road traffic,","venue":null,"work_id":"d0775f9e-f07c-47b7-b44b-5b1524246473","year":2012},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:10.208393Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:bdf633cf051227727e5ca92d4ba82b64e075e7d8f4f85fb1724518143b677e1f","observation_id":"ab3dbb70-193c-45c9-bf85-6051c9ce7b9f","resolution":{"observed_at":"2026-08-06T23:49:19.466504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:10.359278Z","title":"Analysis of optimal velocity model with explicit delay,","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:10.359278Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:c8a265a48ccebc263b4e3aa9fe503578d18b418ecb37708391ad07e88e81bbe4","observation_id":"26bb3be2-7e4b-497b-84b4-8774b67b1c5e","resolution":{"observed_at":"2026-08-06T23:49:10.359278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:19.272343Z","title":"End to end learning for self-driving cars,","venue":null,"work_id":"6abb068e-2248-4879-a969-91a8456cd751","year":null},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:10.458971Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:07ec5582d8ae31b362b6e4c64c920126f7e4f728cf63857af939969a37ea8558","observation_id":"f4ed6449-325b-4c5a-9c88-29689429fb15","resolution":{"observed_at":"2026-08-06T23:49:19.321928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.03079","last_updated":"2018-12-07T16:04:00Z","snapshot_observed_at":"2026-07-06T07:19:51.356709Z","submitted_at":"2018-12-07T16:04:00Z","title":"ChauffeurNet: Learning to Drive by Imitating the Best and Synthesizing the Worst","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.03079","snapshot_observed_at":"2026-08-06T23:49:10.703645Z","title":"Chauffeurnet: Learning to drive by imitating the best and synthesizing the worst,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:10.703645Z"},"links":{"cited_paper":"/paper/1812.03079","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:003e66f9f2fa33ac6876ab78fcbc812342e46de727b094091e165e03d8e8b2d4","observation_id":"5f3ccb8d-1c36-4a81-a3fb-29b51c65009f","resolution":{"observed_at":"2026-08-06T23:49:10.703645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.01196","last_updated":"2018-02-27T03:09:02Z","snapshot_observed_at":"2026-07-06T05:40:33.281941Z","submitted_at":"2017-05-02T22:57:36Z","title":"Navigating Occluded Intersections with Autonomous Vehicles using Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"1705.01196","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.01196","snapshot_observed_at":"2026-08-06T23:49:16.151878Z","title":"Navigating Occluded Intersections with Autonomous Vehicles using Deep Reinforcement Learning","venue":"cs.AI","work_id":"061e442d-def4-4c11-aabc-590e7d05dbc5","year":2017},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:10.825859Z"},"links":{"cited_paper":"/paper/1705.01196","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:8ccdea7d7660d0aab7271c489e096fcf7dfd9820d857a5824ac0a65d18867a85","observation_id":"df52118b-0f50-4af1-b9f2-511523201f97","resolution":{"observed_at":"2026-08-06T23:49:16.254374Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.10469","last_updated":"2018-10-24T16:06:33Z","snapshot_observed_at":"2026-07-06T07:10:20.585902Z","submitted_at":"2018-10-24T16:06:33Z","title":"Learning Negotiating Behavior Between Cars in Intersections using Deep Q-Learning","version":1},"cited_work":{"arxiv_id":"1810.10469","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.10469","snapshot_observed_at":"2026-08-06T23:49:15.938586Z","title":"Learning Negotiating Behavior Between Cars in Intersections using Deep Q-Learning","venue":"cs.LG","work_id":"0e495571-61b7-4eb3-8103-9b6e5951135d","year":2018},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:10.964587Z"},"links":{"cited_paper":"/paper/1810.10469","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:34eb3ee0f23f75ebbf240f510711bb82f924da941f754c7a6d139bd662c2d0a3","observation_id":"41825fd5-c11b-4f55-b155-c0c9ee38ffed","resolution":{"observed_at":"2026-08-06T23:49:16.032798Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.12250","last_updated":"2019-11-27T16:14:15Z","snapshot_observed_at":"2026-08-07T12:58:46.223443Z","submitted_at":"2019-11-27T16:14:15Z","title":"Social Attention for Autonomous Decision-Making in Dense Traffic","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.12250","snapshot_observed_at":"2026-08-06T23:49:11.091194Z","title":"Social attention for autonomous decision-making in dense traffic,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:11.091194Z"},"links":{"cited_paper":"/paper/1911.12250","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:06f52a3f73163f40a4cc1e21b41ca5be8fa082bae75f1913fb3d6bd9f4d2d39d","observation_id":"24ae827a-277c-43c0-9b83-ff267a4b87f0","resolution":{"observed_at":"2026-08-06T23:49:11.091194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:19.119241Z","title":"A multi-task reinforcement learning approach for navigating unsignalized intersections,","venue":null,"work_id":"67a5f73a-7301-440b-b4ea-d3e0d747129a","year":2020},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:11.215996Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:9987029091bda810525beaad05f05ced335393d65d76c3ca64ab0777c69963f8","observation_id":"634a9400-a604-4c21-ab8e-e6b1a4d0976c","resolution":{"observed_at":"2026-08-06T23:49:19.189396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:18.843876Z","title":"Pomdp and hierarchical options mdp with continuous actions for autonomous driving at intersections,","venue":null,"work_id":"26c21d8c-b9bc-4da0-ab76-d63c956b370f","year":2018},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:11.385053Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:b3298285911232582d662d032e6b47b1805f0b86cde34cbca706dbdfb97c1757","observation_id":"cf90fdee-691c-4a1c-9e0f-19d1e152bec2","resolution":{"observed_at":"2026-08-06T23:49:18.944152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.04697","last_updated":"2020-11-09T19:23:26Z","snapshot_observed_at":"2026-08-08T21:26:47.813538Z","submitted_at":"2020-11-09T19:23:26Z","title":"Behavior Planning at Urban Intersections through Hierarchical Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2011.04697","doi":null,"metadata_source":"pith","pith_arxiv_id":"2011.04697","snapshot_observed_at":"2026-08-06T23:49:15.682689Z","title":"Behavior Planning at Urban Intersections through Hierarchical Reinforcement Learning","venue":"cs.RO","work_id":"45caf8d1-94db-494c-ae9d-31a22f7a2a90","year":2020},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:11.506469Z"},"links":{"cited_paper":"/paper/2011.04697","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:f9e7c2890fa051c14e9572dd565d1b0f568e6dd052729d093c8bc893e81aa365","observation_id":"0ba67e87-a373-4f1b-b026-cfd37ff24656","resolution":{"observed_at":"2026-08-06T23:49:15.806518Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:11.624122Z","title":"Action and trajectory planning for urban autonomous driving with hierarchical reinforcement learning,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:11.624122Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:a462e737697b018444e7a33758698f739939ed37a715fe7255adf7afd4d0237a","observation_id":"bbac736c-efe4-496e-b0c8-7f9c88380e02","resolution":{"observed_at":"2026-08-06T23:49:11.624122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:18.574000Z","title":"Safe reinforcement learning on autonomous vehicles,","venue":null,"work_id":"287238ee-b626-4b35-83a3-7f2ffb79481e","year":2018},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:11.854782Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:b46c8501813a9004cc5e9897329f73e7abe5e819b86555df91a8a7289f8500a2","observation_id":"6bac7e8b-6c20-4214-9cb5-17bd944f04bb","resolution":{"observed_at":"2026-08-06T23:49:18.721818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.06783","last_updated":"2022-03-01T03:53:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-09-14T15:54:35Z","title":"Learning to Navigate Intersections with Unsupervised Driver Trait Inference","version":2},"cited_work":{"arxiv_id":"2109.06783","doi":null,"metadata_source":"pith","pith_arxiv_id":"2109.06783","snapshot_observed_at":"2026-08-06T23:49:15.413067Z","title":"Learning to Navigate Intersections with Unsupervised Driver Trait Inference","venue":"cs.RO","work_id":"1860b222-afab-4bbc-a371-f8845c3e0e10","year":2021},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:11.986404Z"},"links":{"cited_paper":"/paper/2109.06783","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:3aba402e001797a35b777f4bd286b55c2dde0f76ed68d403a972cc8ca7a16006","observation_id":"eb576bdf-531c-4c0f-b9fd-d411cf778a2b","resolution":{"observed_at":"2026-08-06T23:49:15.505005Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:18.292496Z","title":"Human-like decision making at unsignalized intersections using social value ori- entation,","venue":null,"work_id":"e582743a-5d6a-4da8-8ea5-f5da32177283","year":2024},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:12.093783Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:beb568d6f0ae6c74f58b7f285efeab84ed1a6b385f1b795edd0602c947494ee4","observation_id":"6bc65589-4427-468b-a705-8815a3094f37","resolution":{"observed_at":"2026-08-06T23:49:18.415770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:18.001834Z","title":"Interactive autonomous navigation with internal state inference and interactivity estimation,","venue":null,"work_id":"97f10ee4-9ab4-496a-a218-0974a33cb568","year":2024},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:12.243166Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:b907df5b1b69d2f13cbf1539019b87e3610de5085fe7dd810b3a03745bd4503f","observation_id":"91f99a7a-e874-4936-9487-37a3581c1db0","resolution":{"observed_at":"2026-08-06T23:49:18.127625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:17.759288Z","title":"Between mdps and semi-mdps: A framework for temporal abstraction in reinforcement learning,","venue":null,"work_id":"8aa900d0-728f-4b7b-8384-dc8b3d0e9fdc","year":1999},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:12.391343Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:74b358399e854f0598f717e726203181a3da59a892f37abedc1a6e6e5e2fec3f","observation_id":"d8417676-b812-4f2e-ab62-313a174f5141","resolution":{"observed_at":"2026-08-06T23:49:17.849826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:12.500305Z","title":"Feudal reinforcement learning,","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:12.500305Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:f08aa0f497eb8d3d54177a9f41c558b2e021897203b3c6ac0e36ddad786f937d","observation_id":"bcaaddc6-da14-4cf4-9159-1a266599e13a","resolution":{"observed_at":"2026-08-06T23:49:12.500305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1604.06057","last_updated":"2016-05-31T14:45:58Z","snapshot_observed_at":"2026-07-06T04:53:33.721115Z","submitted_at":"2016-04-20T18:47:48Z","title":"Hierarchical Deep Reinforcement Learning: Integrating Temporal Abstraction and Intrinsic Motivation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1604.06057","snapshot_observed_at":"2026-08-06T23:49:12.644637Z","title":"Hierarchical deep reinforcement learning: Integrating temporal abstraction and intrinsic motivation,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:12.644637Z"},"links":{"cited_paper":"/paper/1604.06057","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:389b7bb3f9d132fd6996b2abbe28be74ec322578687dfcd61e10255783e9bc9f","observation_id":"b1b5c3f8-d11b-48c9-84c0-67c1bff50f6f","resolution":{"observed_at":"2026-08-06T23:49:12.644637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.08296","last_updated":"2018-10-05T12:39:37Z","snapshot_observed_at":"2026-07-06T06:40:24.763407Z","submitted_at":"2018-05-21T21:33:44Z","title":"Data-Efficient Hierarchical Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.08296","snapshot_observed_at":"2026-08-06T23:49:12.786912Z","title":"Data-efficient hierarchical reinforcement learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:12.786912Z"},"links":{"cited_paper":"/paper/1805.08296","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:ed41173c16ab484dbf16979a9bcf9b605383813e6be8903a3e7d1f0c0a7fdaea","observation_id":"1a17800a-5966-4d80-8d93-b589c280009d","resolution":{"observed_at":"2026-08-06T23:49:12.786912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.00948","last_updated":"2019-09-03T21:05:21Z","snapshot_observed_at":"2026-08-06T00:36:08.175723Z","submitted_at":"2017-12-04T08:18:08Z","title":"Learning Multi-Level Hierarchies with Hindsight","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.00948","snapshot_observed_at":"2026-08-06T23:49:12.947806Z","title":"Learning multi-level hierarchies with hindsight,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:12.947806Z"},"links":{"cited_paper":"/paper/1712.00948","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:39dac277bb17f31a6a7ecf6817ad355c2f968e3fced991d94c99edb091acae5a","observation_id":"77b7febc-4a27-4da2-bba3-9c65c30fe74c","resolution":{"observed_at":"2026-08-06T23:49:12.947806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:17.543931Z","title":"Multipath: Multiple probabilistic anchor trajectory hypotheses for behavior prediction,","venue":null,"work_id":"774766a5-4eca-422f-aee6-b0a50913926c","year":null},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:13.093012Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:a368862ae13ca14653890634e17d2d50f5efde0e3f8281ad416ab74234bd3fb1","observation_id":"a06babb2-978f-4762-b0cd-9c6a32bb8c83","resolution":{"observed_at":"2026-08-06T23:49:17.642287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.13732","last_updated":"2020-07-27T17:59:49Z","snapshot_observed_at":"2026-08-01T18:17:04.596583Z","submitted_at":"2020-07-27T17:59:49Z","title":"Learning Lane Graph Representations for Motion Forecasting","version":1},"cited_work":{"arxiv_id":"2007.13732","doi":null,"metadata_source":"pith","pith_arxiv_id":"2007.13732","snapshot_observed_at":"2026-08-06T23:49:15.054435Z","title":"Learning Lane Graph Representations for Motion Forecasting","venue":"cs.CV","work_id":"fea08cde-3aad-4615-b747-8af059cbd847","year":2020},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:13.400237Z"},"links":{"cited_paper":"/paper/2007.13732","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:a08ed29c43863bad0f19d65095f6c871b1374ec0dd38965a11dcd7722dc4df66","observation_id":"6461e5fb-e054-4672-83cf-106621710998","resolution":{"observed_at":"2026-08-06T23:49:15.123765Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.08294","last_updated":"2020-08-21T07:33:10Z","snapshot_observed_at":"2026-07-06T09:48:19.033988Z","submitted_at":"2020-08-19T06:52:46Z","title":"TNT: Target-driveN Trajectory Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.08294","snapshot_observed_at":"2026-08-06T23:49:13.523673Z","title":"Tnt: Target-driven trajectory prediction,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:13.523673Z"},"links":{"cited_paper":"/paper/2008.08294","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:9a9688c68dc9dc34b2e56ea8dc168ec0bf95e321b4cdfd75035e7189ceb98b43","observation_id":"42429821-ae29-4de1-b089-6cf453b50753","resolution":{"observed_at":"2026-08-06T23:49:13.523673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:13.652077Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:13.652077Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:2f9493a6142ee09e7a49e0d41be43af6aa1a743cf0a8b247192857582aa538a3","observation_id":"c66819fc-126f-4661-a848-982f4ad85d6f","resolution":{"observed_at":"2026-08-06T23:49:13.652077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03939","last_updated":"2023-02-08T08:32:16Z","snapshot_observed_at":"2026-07-06T14:49:34.232234Z","submitted_at":"2023-02-08T08:32:16Z","title":"Learning Interaction-aware Motion Prediction Model for Decision-making in Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.03939","snapshot_observed_at":"2026-08-06T23:49:13.760119Z","title":"Learning interaction- aware motion prediction model for decision-making in autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:13.760119Z"},"links":{"cited_paper":"/paper/2302.03939","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:9485d02de82c6792a8dd1a6834b260a6d95b131a7a7edb836d4c2f69f1404bf6","observation_id":"45fc5354-722d-43df-b207-f9136d67e99a","resolution":{"observed_at":"2026-08-06T23:49:13.760119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.08417","last_updated":"2022-03-04T20:25:25Z","snapshot_observed_at":"2026-07-06T11:19:38.321360Z","submitted_at":"2021-06-15T20:20:44Z","title":"Scene Transformer: A unified architecture for predicting multiple agent trajectories","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.08417","snapshot_observed_at":"2026-08-06T23:49:13.842331Z","title":"Scene transformer: A unified architecture for predicting multiple agent trajectories,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:13.842331Z"},"links":{"cited_paper":"/paper/2106.08417","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:b50e2bf01519f431dc2bfb04bdbc995ac3ccb4a4c31700aa496e594486b5ef3d","observation_id":"a999beb6-da79-46da-aaed-6ccd82a66ce4","resolution":{"observed_at":"2026-08-06T23:49:13.842331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.04259","last_updated":"2020-05-08T19:07:03Z","snapshot_observed_at":"2026-08-05T22:28:40.124633Z","submitted_at":"2020-05-08T19:07:03Z","title":"VectorNet: Encoding HD Maps and Agent Dynamics from Vectorized Representation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.04259","snapshot_observed_at":"2026-08-06T23:49:13.943431Z","title":"Vectornet: Encoding HD maps and agent dynamics from vectorized representation,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:13.943431Z"},"links":{"cited_paper":"/paper/2005.04259","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:4bcf221b4a12a3701611d9f54d0f24f9d4bfae2a2a739476de615b33b18541be","observation_id":"b785a379-6c96-4f74-bb76-b26ffe255d2d","resolution":{"observed_at":"2026-08-06T23:49:13.943431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-06T23:49:14.075473Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:14.075473Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:140e68a11476523f5b626a18e4635bf5c3c8233c1f3ccde226932b7c266cbb5a","observation_id":"e6714b33-faaf-4814-917b-6be7996d76dd","resolution":{"observed_at":"2026-08-06T23:49:14.075473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:17.257944Z","title":"Separating axis theorem for oriented bounding boxes,","venue":null,"work_id":"de589eb2-4c9b-4632-846b-f76d156f86d9","year":null},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:14.202926Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:0a8346744cf60587a8670e36b08c7361116d1f68d39eca438be91bf506d413e2","observation_id":"dbe86f36-d6bf-4406-b8f7-077166cb340c","resolution":{"observed_at":"2026-08-06T23:49:17.396641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T23:49:14.419292Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:14.419292Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:3288d321866efb46a98ad81472a977856a3c2a895470c179ee4f75e71a8e4ac1","observation_id":"1a012cb7-39e4-4159-b9e1-ff95033a6cce","resolution":{"observed_at":"2026-08-06T23:49:14.419292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.09776","last_updated":"2020-11-01T01:32:36Z","snapshot_observed_at":"2026-08-04T02:16:12.249684Z","submitted_at":"2020-10-19T18:26:10Z","title":"SMARTS: Scalable Multi-Agent Reinforcement Learning Training School for Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.09776","snapshot_observed_at":"2026-08-06T23:49:14.539948Z","title":"Smarts: Scalable multi-agent reinforcement learning training school for autonomous driving,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:14.539948Z"},"links":{"cited_paper":"/paper/2010.09776","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:5840be3def631330257c68181feb1776d831f42314ae111cc927f3e962bba2df","observation_id":"21ce2981-ed5c-403d-a2ca-899d11809ae8","resolution":{"observed_at":"2026-08-06T23:49:14.539948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-06T23:49:14.675888Z","title":"Playing atari with deep reinforcement learning,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:14.675888Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:1003a8bb6596bb0bf2ae2dd9d07893de8fd8d58ea4e69db50b9ffdcd60c3f80c","observation_id":"14840db5-cc5f-4874-bc3a-3300ae42800d","resolution":{"observed_at":"2026-08-06T23:49:14.675888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.07207","last_updated":"2019-10-18T09:17:44Z","snapshot_observed_at":"2026-08-06T11:56:09.577967Z","submitted_at":"2019-10-16T08:11:08Z","title":"Soft Actor-Critic for Discrete Action Settings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.07207","snapshot_observed_at":"2026-08-06T23:49:14.797853Z","title":"Soft actor-critic for discrete action settings,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:14.797853Z"},"links":{"cited_paper":"/paper/1910.07207","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:e06cb044dc098ec8977ad4b44ff2ade2dc44b6e4136b661a627fd065bf82eeb2","observation_id":"7b6c6c6b-ad19-4b2e-8a59-d6bf083e2595","resolution":{"observed_at":"2026-08-06T23:49:14.797853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:49:16.999238Z","title":"Available: https://api.semanticscholar.org/CorpusID: 125587700","venue":null,"work_id":"188ca486-3e25-4d68-b105-7397f214f945","year":null},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":2009,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:14.338878Z"},"links":{"citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:491d59bd9ebb3d7cea0806d39e9691ac7867f44e7a309798706507ccac2e4af0","observation_id":"8a9c4364-e1e3-4d73-9c04-347d07237822","resolution":{"observed_at":"2026-08-06T23:49:17.124427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1604.07316","last_updated":"2016-04-25T16:03:56Z","snapshot_observed_at":"2026-07-06T04:53:59.754200Z","submitted_at":"2016-04-25T16:03:56Z","title":"End to End Learning for Self-Driving Cars","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1604.07316","snapshot_observed_at":"2026-08-06T23:49:10.555549Z","title":"Available: https://arxiv.org/abs/1604.07316","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:10.555549Z"},"links":{"cited_paper":"/paper/1604.07316","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:e364687cf02824e099a1668dee218a45ad3ab75feced5f9f549a810ec0b14274","observation_id":"4b2a6ee0-ded9-4b99-b15c-865d88d30efe","resolution":{"observed_at":"2026-08-06T23:49:10.555549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.05449","last_updated":"2019-10-12T00:34:37Z","snapshot_observed_at":"2026-08-04T23:16:21.521818Z","submitted_at":"2019-10-12T00:34:37Z","title":"MultiPath: Multiple Probabilistic Anchor Trajectory Hypotheses for Behavior Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.05449","snapshot_observed_at":"2026-08-06T23:49:13.253143Z","title":"Available: https://arxiv.org/abs/1910.05449","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:13.253143Z"},"links":{"cited_paper":"/paper/1910.05449","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:9504cd1f2cd23a55a490038fd1684d75b604cc46e62fb7b99543b5596ab2538c","observation_id":"09da6045-488f-4dcb-ab9f-b449363a2107","resolution":{"observed_at":"2026-08-06T23:49:13.253143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15968","last_updated":"2023-06-28T07:11:02Z","snapshot_observed_at":"2026-07-06T15:47:38.256580Z","submitted_at":"2023-06-28T07:11:02Z","title":"Action and Trajectory Planning for Urban Autonomous Driving with Hierarchical Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15968","snapshot_observed_at":"2026-08-06T23:49:11.735202Z","title":"Available: https://arxiv.org/abs/2306.15968","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:11.735202Z"},"links":{"cited_paper":"/paper/2306.15968","citing_paper":"/paper/2506.16336"},"observation_digest":"sha256:809f631fe06b35629ee9b76db76e6715946d713be3e6b67cd04cc11ca8ffc68b","observation_id":"e0ee5f6a-6b20-4728-b96b-b6eb5f78f3c2","resolution":{"observed_at":"2026-08-06T23:49:11.735202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.16336","last_updated":"2025-06-19T14:14:55Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-08T07:57:08.740974Z","submitted_at":"2025-06-19T14:14:55Z","title":"Goal-conditioned Hierarchical Reinforcement Learning for Sample-efficient and Safe Autonomous Driving at Intersections"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":7,"verified_fuzzy":11},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2506.16336."}