{"as_of":"2026-08-08T02:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9f87f036ebaa6160213340b88bd2170fb57724c89a48b186976e3be323e1ca23","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:32:08.717760Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.24317/citation-record","integrity":"/paper/2505.24317/integrity","json":"/paper/2505.24317/citation-record.json","paper":"/paper/2505.24317"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:32:12.172769Z","title":"In: 2024 27th International Conference on Computer Supported Cooperative Work in Design (CSCWD), pp","venue":null,"work_id":"3dbd9f2f-a397-4aa6-9091-469ab2994230","year":2024},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:05.165044Z"},"links":{"citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:78b3a7bf503a01efccd129e9215a7410f4a64f83a033f44281c73f8f37e96c39","observation_id":"03375ff9-5275-4cf3-9d85-9e89b075252b","resolution":{"observed_at":"2026-08-07T12:32:12.277018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:32:05.314675Z","title":"IEEE/ASME Transactions on Mechatronics29(4), 2983–2990 (2024) https://doi.org/10.1109/ TMECH.2024.3402126","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:05.314675Z"},"links":{"citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:f34af9309dc94a9c957f9ba15cffb71455f8b00f3793b3dd8d959d6706245112","observation_id":"abad79dd-3464-43e2-8ec0-fea404e75d93","resolution":{"observed_at":"2026-08-07T12:32:05.314675Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:32:11.960087Z","title":"In: Leonardis, A., Ricci, E., Roth, S., Russakovsky, O., Sattler, T., Varol, G","venue":null,"work_id":"6c331b12-7723-45e3-b86b-e7b20766693c","year":2025},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:05.479478Z"},"links":{"citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:a7dad73f6a7422b3635837ac49b83fe45484577d0335d2cc7137ad2b85893bb9","observation_id":"35ac47b3-7c3a-4d55-891e-77efed9c2986","resolution":{"observed_at":"2026-08-07T12:32:12.050653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:32:11.812094Z","title":"IEEE Transactions on Vehicular Technology69(10), 10581–10595 (2020)","venue":null,"work_id":"dcb24731-2fed-48d3-94d7-bac94e0dacc8","year":2020},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:05.577289Z"},"links":{"citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:2c02db2c7c73d222aeb5ab396c7de05d4bd8e7bb5f87853a71327fdad23fa8ac","observation_id":"2da82746-2244-407a-8899-2b019ea3a9b3","resolution":{"observed_at":"2026-08-07T12:32:11.905653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:32:11.637900Z","title":"IEEE Transactions on Vehicular Technology (2024)","venue":null,"work_id":"7a332f82-b768-44a6-a00a-8ad99a802039","year":2024},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:05.693687Z"},"links":{"citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:9807c99a89431d13478d18ca3872d201acb250d2ad7a6309541069be05db44d7","observation_id":"f89bef85-9e72-45e9-b10f-146be4662c0b","resolution":{"observed_at":"2026-08-07T12:32:11.712656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:32:11.406234Z","title":"CAD Computer-Aided Design 21(S23), 175–190 (2024)","venue":null,"work_id":"bd8dae00-2449-48c9-95c1-cefc6e5fa911","year":2024},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:05.833971Z"},"links":{"citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:fcab953cb0cb579c8c1921c407f43d19487ba1f4a39b0a90b6dea5382a6aa499","observation_id":"c4c31e79-b9cb-40b9-9c17-ad43c7850d09","resolution":{"observed_at":"2026-08-07T12:32:11.536212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7467.36976","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:32:09.790194Z","title":"In: Pro- ceedings of the 2024 4th International Conference on Internet of Things and Machine Learning","venue":null,"work_id":"b8720aa6-f5ad-4ad5-8469-7507e142ee38","year":2024},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:05.960583Z"},"links":{"citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:342549ce02e5daaad939b70c01d0978d6533380df99fcfe0ca4f369136fa2874","observation_id":"b0cc49ce-0977-4918-8584-037d1326ae79","resolution":{"observed_at":"2026-08-07T12:32:09.854312Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.13906","last_updated":"2022-03-11T23:40:20Z","snapshot_observed_at":"2026-07-06T11:04:30.929441Z","submitted_at":"2021-04-28T17:41:35Z","title":"Reward (Mis)design for Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.13906","snapshot_observed_at":"2026-08-07T12:32:06.088602Z","title":"https://arxiv.org/abs/2104.13906","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:06.088602Z"},"links":{"cited_paper":"/paper/2104.13906","citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:8a282272a732d157497522c960f5282deaa4d7c387f132340582b3929ac980d3","observation_id":"bacbebcc-3cf8-475f-9d01-4aaa7ca5c75a","resolution":{"observed_at":"2026-08-07T12:32:06.088602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04764","last_updated":"2024-02-07T11:27:45Z","snapshot_observed_at":"2026-08-05T18:35:49.744409Z","submitted_at":"2024-02-07T11:27:45Z","title":"Code as Reward: Empowering Reinforcement Learning with VLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04764","snapshot_observed_at":"2026-08-07T12:32:06.225854Z","title":"arXiv preprint arXiv:2402.04764 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:06.225854Z"},"links":{"cited_paper":"/paper/2402.04764","citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:5803af0f6add2eac1a05f669258f329a13b1e7f94771abfe806c16415e7bc49d","observation_id":"e396fd48-22c8-4565-b614-62d706214967","resolution":{"observed_at":"2026-08-07T12:32:06.225854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03681","last_updated":"2024-06-14T21:10:32Z","snapshot_observed_at":"2026-08-02T19:29:16.535750Z","submitted_at":"2024-02-06T04:06:06Z","title":"RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03681","snapshot_observed_at":"2026-08-07T12:32:06.318385Z","title":"arXiv preprint arXiv:2402.03681 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:06.318385Z"},"links":{"cited_paper":"/paper/2402.03681","citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:a871b2d551847d2e0e2606cb2bd0519a09cb0fcd9e62ee5749b28dda63fabf74","observation_id":"aad52432-1358-4d8d-8388-110825fd8d6a","resolution":{"observed_at":"2026-08-07T12:32:06.318385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15544","last_updated":"2024-12-20T04:08:11Z","snapshot_observed_at":"2026-08-06T17:28:05.501969Z","submitted_at":"2024-12-20T04:08:11Z","title":"VLM-RL: A Unified Vision Language Models and Reinforcement Learning Framework for Safe Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15544","snapshot_observed_at":"2026-08-07T12:32:06.483874Z","title":"arXiv preprint arXiv:2412.15544 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:06.483874Z"},"links":{"cited_paper":"/paper/2412.15544","citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:f0780cd0010ae76410767656888875e33e04bd4c3741c8cec497676d541db1d1","observation_id":"1c2138c5-3554-40fe-b0f0-fa912caa0c04","resolution":{"observed_at":"2026-08-07T12:32:06.483874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18476","last_updated":"2024-02-28T16:57:22Z","snapshot_observed_at":"2026-07-06T17:36:56.979448Z","submitted_at":"2024-02-28T16:57:22Z","title":"IBD: Alleviating Hallucinations in Large Vision-Language Models via Image-Biased Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18476","snapshot_observed_at":"2026-08-07T12:32:06.649034Z","title":"arXiv preprint arXiv:2402.18476 (2024) 16","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:06.649034Z"},"links":{"cited_paper":"/paper/2402.18476","citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:17f6bc194cd723e9e413afd05dec0743f0df2644dfb7fec7a1ba67708a03c7f5","observation_id":"ab8d28a8-ac03-4f40-b8dc-2f2d949f7668","resolution":{"observed_at":"2026-08-07T12:32:06.649034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02032","last_updated":"2025-03-16T06:51:13Z","snapshot_observed_at":"2026-08-06T05:55:18.425562Z","submitted_at":"2024-08-04T13:50:17Z","title":"Self-Introspective Decoding: Alleviating Hallucinations for Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02032","snapshot_observed_at":"2026-08-07T12:32:06.779028Z","title":"https://arxiv.org/abs/2408.02032","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:06.779028Z"},"links":{"cited_paper":"/paper/2408.02032","citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:ce6414c9a0c7ed19640a86d2949b8af16c58928bbd069ae663497880e634d355","observation_id":"6d96db2a-e4a8-49ab-a7ea-03648c280c7e","resolution":{"observed_at":"2026-08-07T12:32:06.779028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00253","last_updated":"2024-05-06T01:10:01Z","snapshot_observed_at":"2026-07-06T17:23:26.913214Z","submitted_at":"2024-02-01T00:33:21Z","title":"A Survey on Hallucination in Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00253","snapshot_observed_at":"2026-08-07T12:32:06.894494Z","title":"arXiv preprint arXiv:2402.00253 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:06.894494Z"},"links":{"cited_paper":"/paper/2402.00253","citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:c9417fc48801b1e74fd619271c2fa1ebbf39533560ef2f5033251774df0a6900","observation_id":"83b0a0d8-9b75-4258-801b-91cac5758c75","resolution":{"observed_at":"2026-08-07T12:32:06.894494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:32:06.991756Z","title":"Transport Reviews41(5), 556–577 (2021) https://doi.org/10.1080/01441647.2020.1862355","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:06.991756Z"},"links":{"citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:346134f18bbf32d62e9a0c16c3c93fe4d319d469b5d8b5e27af1f0eb6ff70c9c","observation_id":"3eb16ee7-e41d-4e40-8e2a-b404b7836670","resolution":{"observed_at":"2026-08-07T12:32:06.991756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s10676-021-09605-y","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:32:09.001154Z","title":"Ethics and Information Technology23(4), 657–673 (2021) https://doi","venue":null,"work_id":"fb144009-9081-47f6-b3f0-30208cea5dd5","year":2021},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:07.159201Z"},"links":{"citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:d5d696a4e0dc0b6a8401b3e138484d81fdad550a1fa387c1b7fe9714ecbca68d","observation_id":"d3cb0113-cdee-4e7c-aaba-30b757d50e9f","resolution":{"observed_at":"2026-08-07T12:32:09.078606Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2214/ajr.21.27224","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:32:08.818310Z","title":"American Journal of Roentgenology219(1), 152–156 (2022) https://doi.org/10.2214/AJR.21.27224 https://doi.org/10.2214/AJR.21.27224","venue":null,"work_id":"247b0af2-9fca-49b2-9b23-dd589d0d5da9","year":2022},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:07.275988Z"},"links":{"citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:86b4d89e5d68cb1121e86c44dd0e4e85b24d411f626a9f0f00e2a57a81969dcd","observation_id":"f2574f1f-97da-4f03-a56d-b256f986d7c9","resolution":{"observed_at":"2026-08-07T12:32:08.917973Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T12:32:07.425486Z","title":"arXiv preprint arXiv:2010.11929 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:07.425486Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:10c32647d82642133509377fe8a8dd50f933eddb680bc4b91084e205f0435441","observation_id":"5e6175e9-1480-477d-9a84-b5a575ab096b","resolution":{"observed_at":"2026-08-07T12:32:07.425486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:32:11.137693Z","title":"Accessed: 2025-01-21 (2019)","venue":null,"work_id":"9cd303d2-5ca6-4f9b-9683-ee7bbd98173a","year":2019},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:07.534664Z"},"links":{"citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:39dd995f23b54fe5037ae3a21f92179ec9c93ffe7b36f8ee305d8b077ff28ac0","observation_id":"e381fcf6-6c70-474c-b3f3-e9100b392857","resolution":{"observed_at":"2026-08-07T12:32:11.275591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:32:10.917065Z","title":"IEEE transactions on pattern analysis and machine intelligence45(3), 3461–3475 (2022)","venue":null,"work_id":"9c8a63ce-2cbc-4ebe-86f7-4114ffe094f9","year":2022},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:07.719610Z"},"links":{"citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:16511b0270d426f7feeb30c2aea9ad93e2c817f3212405b2e19e7e860f3a18ff","observation_id":"50426225-14ad-44c9-b764-efba791bc7d9","resolution":{"observed_at":"2026-08-07T12:32:11.011472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:32:10.740650Z","title":"In: Leonardis, A., Ricci, E., Roth, S., Russakovsky, O., Sattler, T., Varol, G","venue":null,"work_id":"63311172-5093-482b-8996-c14af919f25f","year":2024},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:07.839838Z"},"links":{"citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:59240a01f84e8d691aa3e0b02f1a9883e4ec8cdbc73e76a4b68f612d7e2b9c2a","observation_id":"05644651-6d70-48f0-9ce1-ac8c0f8e5857","resolution":{"observed_at":"2026-08-07T12:32:10.838612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07162","last_updated":"2023-07-14T05:18:34Z","snapshot_observed_at":"2026-08-07T22:17:22.677596Z","submitted_at":"2023-07-14T05:18:34Z","title":"Drive Like a Human: Rethinking Autonomous Driving with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.07162","snapshot_observed_at":"2026-08-07T12:32:07.976936Z","title":"https: //arxiv.org/abs/2307.07162","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:07.976936Z"},"links":{"cited_paper":"/paper/2307.07162","citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:3cbb31ca4fbe5cb8c5e75749141a41640971d63dd8fe8f0eb33bcc947a6a1a06","observation_id":"6acbec36-03b9-41b5-94e6-13165393f7ed","resolution":{"observed_at":"2026-08-07T12:32:07.976936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:32:10.539671Z","title":"https://arxiv.org/abs/2503","venue":null,"work_id":"7ba6bdd6-2cbf-4049-bb73-e264c29fef55","year":2025},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:08.052738Z"},"links":{"citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:ff63f998b1a1caee120ed85d8e4428040461c29c5354c2b091138f4672c824ab","observation_id":"2cd4f015-0a20-478c-ad68-4ff94cdda037","resolution":{"observed_at":"2026-08-07T12:32:10.658285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18965","last_updated":"2024-03-27T19:30:06Z","snapshot_observed_at":"2026-08-02T15:10:01.448733Z","submitted_at":"2024-03-27T19:30:06Z","title":"LORD: Large Models based Opposite Reward Design for Autonomous Driving","version":1},"cited_work":{"arxiv_id":"2403.18965","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.18965","snapshot_observed_at":"2026-08-07T12:32:09.350359Z","title":"LORD: Large Models based Opposite Reward Design for Autonomous Driving","venue":"cs.RO","work_id":"ae1ea25b-184d-4724-833d-57be1b6af9d3","year":2024},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:08.159902Z"},"links":{"cited_paper":"/paper/2403.18965","citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:d3bab04c02b264203de788b056acee8c52fffb6a9af134528555d3e548c7224c","observation_id":"bfd55fa6-d5fb-48b7-a593-3345fb6d6948","resolution":{"observed_at":"2026-08-07T12:32:09.420564Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.11419","last_updated":"2023-08-10T19:29:11Z","snapshot_observed_at":"2026-07-06T14:33:47.984474Z","submitted_at":"2022-12-21T23:59:33Z","title":"Imitation Is Not Enough: Robustifying Imitation with Reinforcement Learning for Challenging Driving Scenarios","version":2},"cited_work":{"arxiv_id":"2212.11419","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.11419","snapshot_observed_at":"2026-08-07T12:32:09.181663Z","title":"Imitation Is Not Enough: Robustifying Imitation with Reinforcement Learning for Challenging Driving Scenarios","venue":"cs.AI","work_id":"86ad06bd-33b2-430e-8323-e732dd7557d4","year":2022},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:08.289337Z"},"links":{"cited_paper":"/paper/2212.11419","citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:7f0829b52857f32d64dab1f0344def0056338d7d06444cd499651ed6c76e6ec1","observation_id":"a6784a18-dedc-406a-9b1f-565d10f41798","resolution":{"observed_at":"2026-08-07T12:32:09.265746Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:32:10.311793Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pp","venue":null,"work_id":"f82c9fb2-d854-4c50-a10c-37e79ca01f72","year":2023},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:08.376702Z"},"links":{"citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:fcd94bb708af2d97dd15c6d94f3a49d15da8126396a90f5180d57d9c8b3e2901","observation_id":"0a3455ee-7f4c-4889-90c0-fe1af10772e7","resolution":{"observed_at":"2026-08-07T12:32:10.405350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-07T12:32:08.454107Z","title":"https://arxiv.org/abs/2201.11903","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:08.454107Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:5e48d22718c119b6cc8a8cb7e210f6bf5e3977f2e339e426d9450bb498588c63","observation_id":"e83088b1-e390-48a8-968b-e984cfac4671","resolution":{"observed_at":"2026-08-07T12:32:08.454107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:32:10.175770Z","title":"https://openai.com/index/gpt-4o","venue":null,"work_id":"acb394da-4a7b-4b07-b723-8591b6d4ae93","year":2024},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:08.535926Z"},"links":{"citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:742b669381e56e065a7b7b4634a6bb2f2dc39662e91ea76326b50f56cace3c28","observation_id":"fbd41d81-5442-4149-9573-aed68481bb3b","resolution":{"observed_at":"2026-08-07T12:32:10.241848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T12:32:08.636094Z","title":"arXiv preprint arXiv:1707.06347 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:08.636094Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:c8c79866777ea1f3388465880c06647db437efdf2f487c673e5dc02b6bab224f","observation_id":"299ca943-3229-44bb-8676-e2d60e845331","resolution":{"observed_at":"2026-08-07T12:32:08.636094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:32:10.033269Z","title":"https://neo4j.com (2023) 18","venue":null,"work_id":"db6364ea-fa15-48e5-b56d-94037bd52b3d","year":2023},"citing_paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:08.717760Z"},"links":{"citing_paper":"/paper/2505.24317"},"observation_digest":"sha256:7732bb0225d9d2fb00bd67ddb69f3492f483ca7d5319b8cccca528c35e58dead","observation_id":"101708eb-d481-4120-a3e8-5b01e7e63a29","resolution":{"observed_at":"2026-08-07T12:32:10.102480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.24317","last_updated":"2025-05-30T08:00:51Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T12:23:17.728153Z","submitted_at":"2025-05-30T08:00:51Z","title":"ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":1,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":12,"verified_exact":2,"verified_fuzzy":12},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2505.24317."}