{"as_of":"2026-08-18T09:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:380e0447e2e7876968968fae7600c48fe808a81aa4ae91fe8b5204467723b030","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:16:02.508018Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T07:56:55.207988Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05223","snapshot_observed_at":"2026-08-03T07:56:55.207988Z","title":"[Brewittet al., 2021 ] Cillian Brewitt, Balint Gyevnar, Samuel Garcin, and Stefano V Albrecht","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2601.18783","last_updated":"2026-06-01T08:59:51Z","snapshot_observed_at":"2026-08-18T08:49:25.326410Z","submitted_at":"2026-01-26T18:50:21Z","title":"Multi-Objective Reinforcement Learning for Tactical Decision Making for Trucks in Highway Traffic","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-03T07:56:55.207988Z"},"links":{"cited_paper":"/paper/2505.05223","citing_paper":"/paper/2601.18783"},"observation_digest":"sha256:a0eaed37b3c7671170c809bb1a4aee04628e36a14880c27463f6a618e99655c9","observation_id":"1900112c-9271-406c-be81-4b597eb4bb36","resolution":{"observed_at":"2026-08-03T07:56:55.207988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.05223/citation-record","integrity":"/paper/2505.05223/integrity","json":"/paper/2505.05223/citation-record.json","paper":"/paper/2505.05223"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.23262","last_updated":"2025-09-23T04:19:59Z","snapshot_observed_at":"2026-08-16T10:28:44.439043Z","submitted_at":"2024-10-30T17:46:31Z","title":"EMMA: End-to-End Multimodal Model for Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23262","snapshot_observed_at":"2026-08-15T23:16:02.338693Z","title":"Emma: End-to-end multimodal model for autonomous driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.338693Z"},"links":{"cited_paper":"/paper/2410.23262","citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:e43207c05402745bab819f2f51d827af095627b9096978ba47a05c2575e63355","observation_id":"ad383949-887f-4019-bb93-1a9636220cbd","resolution":{"observed_at":"2026-08-15T23:16:02.338693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06978","last_updated":"2024-08-30T03:37:36Z","snapshot_observed_at":"2026-08-18T07:57:58.891611Z","submitted_at":"2024-06-11T06:18:26Z","title":"Hydra-MDP: End-to-end Multimodal Planning with Multi-target Hydra-Distillation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06978","snapshot_observed_at":"2026-08-15T23:16:02.343595Z","title":"Hydra-mdp: End-to-end multimodal planning with multi-target hydra-distillation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.343595Z"},"links":{"cited_paper":"/paper/2406.06978","citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:8b70c1568d6b85831ad16df1c90e55c017aca530a0fee7ea593d1dd686478d9d","observation_id":"7cb0c473-c98e-4ce3-a4f2-9c7e6e023075","resolution":{"observed_at":"2026-08-15T23:16:02.343595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:03.041138Z","title":"Exploration of the acceptability of different behaviors of an autonomous vehicle in so- called conflict situations,","venue":null,"work_id":"fe4519bc-8168-45da-94bc-80d3eea1ad88","year":2023},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.348259Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:dba0dc1aece1f63a2ded7d00e18ddc17033d2626b8a3e03725f4fa805d44dd6e","observation_id":"c000b252-6596-455f-b3fb-9ed1e5608049","resolution":{"observed_at":"2026-08-15T23:16:03.045317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:03.028622Z","title":"Toward adaptive driving styles for automated driving with users’ trust and preferences,","venue":null,"work_id":"fde908e5-9fb3-4be0-a90e-6da482a85901","year":2022},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.352545Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:34d5097ebc811415a4a278440e4b37ab87c5d22bfad59f29d35c19c262e545e3","observation_id":"9b8308ee-e764-448e-94a9-b2a5afaaa5ac","resolution":{"observed_at":"2026-08-15T23:16:03.032982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:03.015850Z","title":"Dynamic preferences in multi-criteria reinforcement learning,","venue":null,"work_id":"7b69bb04-fe37-4ef7-985b-250e8c41c468","year":2005},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.356847Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:ccebeaab4883bc38292e9aa201e32fbf3443c39bab200f2b52a090b0a27d5cae","observation_id":"1f821b89-b78b-4131-8082-1a0987c9c465","resolution":{"observed_at":"2026-08-15T23:16:03.020086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:03.002850Z","title":"User-driven adaptation: Tailoring autonomous driving systems with dynamic preferences,","venue":null,"work_id":"0c586443-270a-4b24-af50-617fbff34869","year":2024},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.361314Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:b56b858fde4a81e409ea8c3ef009ae7cbcf74c36460ab3654d37b8f587b1f1e5","observation_id":"ad0da834-c7b7-4646-aa04-8679a1a27232","resolution":{"observed_at":"2026-08-15T23:16:03.007284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.989482Z","title":"Lexicographic actor-critic deep reinforcement learning for urban autonomous driving,","venue":null,"work_id":"48dd8f39-4103-4cca-a2a6-0ca9892c514a","year":2023},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.365838Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:8221b29c33c40aac893a7d74262854cd0066a97e2a81d81df6d69ccb46a0c18d","observation_id":"74ca8899-4174-4077-94ca-9f81b41b4ad4","resolution":{"observed_at":"2026-08-15T23:16:02.993583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.975758Z","title":"Urban driving with multi-objective deep reinforcement learning,","venue":null,"work_id":"e21f0148-6166-4c21-bc77-b614016166b0","year":2019},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.369853Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:8119d532338a0f2a1bc594b112265c580a05058adbc6a0462137ef9a6fcdcf4c","observation_id":"561aff21-84e3-4f70-b97e-cfcc37937302","resolution":{"observed_at":"2026-08-15T23:16:02.980632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.964078Z","title":"Multi-objective optimization for autonomous driving strategy based on deep q network,","venue":null,"work_id":"cdd4aba0-d43f-46ec-a493-0d6f1588194c","year":2021},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.373974Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:be1b9ff8373725e4731bb600d181f154914f371e55f1538706c034752972b21a","observation_id":"9057dfde-ce7d-42ae-99ec-e63efff497c7","resolution":{"observed_at":"2026-08-15T23:16:02.968134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.951664Z","title":"Porf-ddpg: Learning per- sonalized autonomous driving behavior with progressively optimized reward function,","venue":null,"work_id":"9f4a6224-196f-46ca-a18f-3f495a764e32","year":2020},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.377826Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:4525e32f87a86cc58ef63462fe2de86f98db95c9c2c70345c0d753c3979f89d1","observation_id":"7ba0fb0b-5426-400c-98aa-63f308bbf733","resolution":{"observed_at":"2026-08-15T23:16:02.955898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.937180Z","title":"Toward personalized decision making for au- tonomous vehicles: A constrained multi-objective reinforcement learn- ing technique,","venue":null,"work_id":"1da2d1bd-f6b5-47ec-bce9-017086839561","year":2023},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.382721Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:52252af7cf23fb7a5a487cd99e039b057ad993b05cc060e0aff5a4f7b97a6fa8","observation_id":"e8863148-8459-43b0-8895-bf55974af567","resolution":{"observed_at":"2026-08-15T23:16:02.941621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.924800Z","title":"Navigation in urban environments amongst pedestrians using multi-objective deep reinforcement learning,","venue":null,"work_id":"64f693f9-0059-4c4b-a96c-4b1cfa9a5700","year":2021},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.387662Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:d8daf923f41d40801f5f89bc911a03b91a35094bbc6a79a9e3ae2dbf9186032f","observation_id":"359bb56b-463c-4afd-b6d9-14ac331dc0f3","resolution":{"observed_at":"2026-08-15T23:16:02.928714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.912817Z","title":"Learning driving styles for autonomous vehicles from demonstration,","venue":null,"work_id":"98da9f34-8fc4-40de-803c-1f1c71e8810c","year":2015},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.391875Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:4e2e8db5cff62acbe641a080c34f690ebc29362bd442c684df6ab2c395f040c0","observation_id":"4ffd992c-fd44-4375-93c1-19262e8ad85b","resolution":{"observed_at":"2026-08-15T23:16:02.916769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.900298Z","title":"Driving behavior modeling using naturalistic human driving data with inverse reinforcement learning,","venue":null,"work_id":"45d18558-4144-430d-81d0-b317e092cefa","year":2022},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.395812Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:9c0940ca2e1443caed152d522907d15a8ccc5b605025e483d4011d3b9aea0534","observation_id":"c53b48f1-6e2c-4df3-9957-af718f030752","resolution":{"observed_at":"2026-08-15T23:16:02.904524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.887483Z","title":"Driving with style: Inverse reinforcement learning in general-purpose planning for automated driving,","venue":null,"work_id":"005048d2-4bc1-44fe-a600-beeb44db5bd1","year":2019},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.399629Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:5da1d3e15e52ce095f88a2d926f5e9eff001f4da6e75dabff3fe9f41b51eb2c0","observation_id":"1423acff-d206-4a2d-804c-0c761061c7f3","resolution":{"observed_at":"2026-08-15T23:16:02.891938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.873396Z","title":"Driving style alignment for llm-powered driver agent,","venue":null,"work_id":"33d4f942-9c34-4a73-8d48-93c3155fbcdb","year":2024},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.404163Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:394041273fee928dd19caee455945b2c54885b70de608d399838d881051aa977","observation_id":"077aad96-d089-4b42-aa63-6a5bcef9b9b0","resolution":{"observed_at":"2026-08-15T23:16:02.878217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11694","last_updated":"2024-09-18T04:30:47Z","snapshot_observed_at":"2026-08-16T13:17:37.615672Z","submitted_at":"2024-09-18T04:30:47Z","title":"From Words to Wheels: Automated Style-Customized Policy Generation for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11694","snapshot_observed_at":"2026-08-15T23:16:02.408877Z","title":"From words to wheels: Automated style-customized policy generation for autonomous driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.408877Z"},"links":{"cited_paper":"/paper/2409.11694","citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:512fd95d721e75f91b376e8f931df554e5d9adafb99a38e547795179bf939d00","observation_id":"e58df251-3ad6-4a32-9413-beb472a2ee20","resolution":{"observed_at":"2026-08-15T23:16:02.408877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11913","last_updated":"2024-11-17T23:20:37Z","snapshot_observed_at":"2026-08-14T23:38:29.330365Z","submitted_at":"2024-11-17T23:20:37Z","title":"On-Board Vision-Language Models for Personalized Autonomous Vehicle Motion Control: System Design and Real-World Validation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11913","snapshot_observed_at":"2026-08-15T23:16:02.413186Z","title":"On-board vision-language models for personalized autonomous vehicle motion control: System design and real-world validation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.413186Z"},"links":{"cited_paper":"/paper/2411.11913","citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:b07d043891a2c02c17332eb8b3decf9fe588db14fff82d4b13f2d839a4d6a9e2","observation_id":"2cd0e7ed-9cd2-49bd-83f5-33ce5f9114ce","resolution":{"observed_at":"2026-08-15T23:16:02.413186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.417498Z","title":"A review of personalization in driving behavior: Dataset, modeling, and validation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.417498Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:91f8a5be985a638d39cef6d558533b2bbe2667be113bfacd5f96ee80a7b7da97","observation_id":"4a412504-22b3-4a57-939a-8de803e1b85a","resolution":{"observed_at":"2026-08-15T23:16:02.417498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.852762Z","title":"Self-driving like a human driver instead of a robocar: Personalized comfortable driving experience for autonomous vehicles,","venue":null,"work_id":"efa55e1a-9332-4c5b-9f97-18a186e26b64","year":2019},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.421125Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:f0497350840e23a7f10a31ed25bc9b468c813434c562d0720de3d246c49a3250","observation_id":"35a5f31f-0610-44e8-bf7e-30c1c02e7ea3","resolution":{"observed_at":"2026-08-15T23:16:02.856960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.839082Z","title":"Toward safe and personal- ized autonomous driving: Decision-making and motion control with dpf and cdt techniques,","venue":null,"work_id":"31f7305c-5e88-44e9-a34d-4860117999dd","year":2021},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.425361Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:d9f8f5411a196c3fc7c804997af16d5db06c5399e3b7496ee7c5030c2acf0c35","observation_id":"31e00388-de41-4c44-bf24-50ce56bda75d","resolution":{"observed_at":"2026-08-15T23:16:02.843565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.826384Z","title":"Personalized driving behavior oriented autonomous vehicle control for typical traffic situations,","venue":null,"work_id":"5d13b568-457f-4c84-9d40-3b5e0d224a84","year":2024},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.429305Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:fc0897193d4a3788d170888a93ce4bddcf3c1149504f5a4416481a6d52d9b545","observation_id":"fc1b08bc-aacd-4417-aec8-26782f9708dc","resolution":{"observed_at":"2026-08-15T23:16:02.830825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.813980Z","title":"Recent advancements in end-to-end au- tonomous driving using deep learning: A survey,","venue":null,"work_id":"5218496c-f988-4ccf-bee4-be8fd2f7ace8","year":2023},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.433105Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:c6bf5250637e1c83bdcbf134266aa626cdae820cdd1e7ce12f36326e83760c1d","observation_id":"3ac28ce6-5244-4e55-b70e-9bd8db502ee2","resolution":{"observed_at":"2026-08-15T23:16:02.818302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.800948Z","title":"Personalized car following for autonomous driving with in- verse reinforcement learning,","venue":null,"work_id":"cfe27d34-561b-43e3-8464-b4afa06733b3","year":2022},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.436703Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:b58a5542ab5b3f1fbb58bb704051ca146bf47def0bf57094f83ef960ebc20927","observation_id":"e0f0e82a-4893-47a1-94cc-6b1c92ea3347","resolution":{"observed_at":"2026-08-15T23:16:02.805244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.788116Z","title":"Text-to-drive: Diverse driving behavior synthesis via large language models,","venue":null,"work_id":"13acbaed-64a9-4311-8960-ffd6b1cc7046","year":2024},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.440322Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:8ab581c890340d448f9e17c0959323d0254da4033eb946e843250204725d7b11","observation_id":"042e9b7b-42dc-4411-af6e-6f70aeb325a1","resolution":{"observed_at":"2026-08-15T23:16:02.792782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.776004Z","title":"Multi-objective end-to-end self- driving based on pareto-optimal actor-critic approach,","venue":null,"work_id":"09fadbfc-9d5a-480d-b766-31927c84c97a","year":2021},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.444019Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:137269f030dd4ce05bc4c295da5eb5d6980955688d2089b2088241e5a0415572","observation_id":"66955f68-3c95-4bb5-8944-f43ad62f7f94","resolution":{"observed_at":"2026-08-15T23:16:02.780319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.764088Z","title":"PD-MORL: Preference-driven multi-objective reinforcement learning algorithm,","venue":null,"work_id":"4388f47d-8a16-4c1c-bd2f-fcff978f401d","year":2022},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.447737Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:746bd4354b73ef9ecb91a4580b72e5fef9d4623c9f4ac01f02e860124430177d","observation_id":"957ab936-fa42-47e1-bae2-9839c6383484","resolution":{"observed_at":"2026-08-15T23:16:02.768130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.752834Z","title":"Demonstration- enhanced adaptable multi-objective robot navigation,","venue":null,"work_id":"48d363c6-2d90-4aec-9ef4-1b40c2ddb199","year":2025},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.451339Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:8b307bc13f849f9ebf6ffcad029be6b5b3cc98d4fe9a8050955134a344cca8e7","observation_id":"43a560af-2bcf-4774-a351-0af47448711e","resolution":{"observed_at":"2026-08-15T23:16:02.756710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.740563Z","title":"CARLA: An open urban driving simulator,","venue":null,"work_id":"43f01ffb-78db-4c39-966f-76fe4cfad697","year":2017},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.455744Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:6385bf46306de4a6240d216cbcf419fd3aaa84ba5bbe27b5f6612f0e6c9fe8b8","observation_id":"e21630cf-681c-41c4-8282-39f7c81b8946","resolution":{"observed_at":"2026-08-15T23:16:02.744829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.727414Z","title":"A practical guide to multi-objective reinforcement learning and plan- ning,","venue":null,"work_id":"e2927d22-c3c2-43ab-a55a-e257ab059f38","year":2022},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.460125Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:1968b06e84677993206c2952c0b966466dc7b9bf13d89ec011bb7d63975405f1","observation_id":"016b1561-a8e5-4fd4-b5c6-f4903730e1fc","resolution":{"observed_at":"2026-08-15T23:16:02.732009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.715538Z","title":"Prediction- guided multi-objective reinforcement learning for continuous robot control,","venue":null,"work_id":"53d5d955-a7aa-4d1b-adaf-8dd0bbdc2757","year":2020},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.464087Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:a166a05cd3c0f539cbe1756ef29a6870e1c7ca1dbd562c5e266074d4700940ff","observation_id":"5d38c2ef-ec9e-46cd-b666-fb484394f327","resolution":{"observed_at":"2026-08-15T23:16:02.719502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.703320Z","title":"End-to- end reinforcement learning for autonomous longitudinal control using advantage actor critic with temporal context,","venue":null,"work_id":"20a031fd-e8ff-475a-9ca4-1b965567f6a3","year":2019},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.467907Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:a3119d6a6ee4347c06d1b51cac76e2174dae157176cfb4dd699acb077b2fd940","observation_id":"3ad0a038-4514-4861-8603-5d8b84939a1f","resolution":{"observed_at":"2026-08-15T23:16:02.707534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.691098Z","title":"PASRL: Stabilising reinforcement learning with past action-state representation learning,","venue":null,"work_id":"73220257-8cb3-41ab-b964-cce2ff53ee7d","year":2024},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.471935Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:a261b6a57a8bd552d5a9f7625e5b674856610aeefa8091e7b1335a27de1986b1","observation_id":"094a07a4-a3df-4b96-a1c8-4b72f70692cd","resolution":{"observed_at":"2026-08-15T23:16:02.695562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.679193Z","title":"Transfuser: Imitation with transformer-based sensor fusion for au- tonomous driving,","venue":null,"work_id":"b6bb1acf-ce0a-4bd7-96eb-2425ae5e2e7c","year":2022},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.476483Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:e817854d45de4054bc1b46cb6b941319e94c5530e117e1ac94c46a4adb74a8a9","observation_id":"c8c4686a-a6ca-40b7-a822-04e2cf62706a","resolution":{"observed_at":"2026-08-15T23:16:02.683437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.480297Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.480297Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:9b43ccd1c1fe2d9527032e5d4648b6d6603ca4074ab802c03abba12f32bf4de8","observation_id":"5318ac18-48f4-422b-aea7-b8a48da84e23","resolution":{"observed_at":"2026-08-15T23:16:02.480297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.660777Z","title":"Model-free deep reinforcement learning for urban autonomous driving,","venue":null,"work_id":"1f81bb0c-a58e-402e-8f82-5e72a91cae8e","year":2019},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.483702Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:da03c6017cc3c781dc756007aa3652307149c0d0d7181463cf9b93716d535651","observation_id":"587274d3-436a-407e-814d-fa257416c99b","resolution":{"observed_at":"2026-08-15T23:16:02.664667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.648739Z","title":"End-to-end model-free reinforcement learning for urban driving using implicit affordances,","venue":null,"work_id":"e26dc99f-de60-4516-bbe4-b4998c605007","year":2020},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.488173Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:0f860f82066404a83a45b020e9f232fdfcd6fe36e6700ef07b084dc0318d1862","observation_id":"b67b49f6-58fd-4b0e-adea-6c47df2af612","resolution":{"observed_at":"2026-08-15T23:16:02.652997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.636369Z","title":"Prioritized experience-based reinforcement learning with human guidance for autonomous driving,","venue":null,"work_id":"58292191-a83a-47d3-af31-e797cdff0f03","year":2024},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.492185Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:3b1f1eb3f898df0f4b825b7beafcee5b6c024ae98e7e39fe9a7de882e64041a0","observation_id":"80df87dd-b42e-441c-88ee-c40488bd2841","resolution":{"observed_at":"2026-08-15T23:16:02.640310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.624325Z","title":"Carla leaderboard,","venue":null,"work_id":"58b86df7-e95c-4bd8-909b-ac8d9bf20c42","year":2023},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.496103Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:f7185595126faccd1329125a82480e2d58632fbbab076bb43f3738f90ea89dbb","observation_id":"e99656ec-f3fe-4a2c-b7f7-5d5d62bcf63c","resolution":{"observed_at":"2026-08-15T23:16:02.628267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.611423Z","title":"Privileged sensing scaffolds reinforcement learning,","venue":null,"work_id":"742581c7-8623-41b4-a4e1-1f119de50065","year":2024},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.499933Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:ace062566e858444d4b809d1f76df9602ec50daf4174951150a3ce0795e03dca","observation_id":"61b8e8d3-fe9b-4c68-a58f-1b1fa2ed24f0","resolution":{"observed_at":"2026-08-15T23:16:02.615953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.598099Z","title":"Human-level control through deep reinforcement learning,","venue":null,"work_id":"ad035416-4c3e-4c01-a421-8bec357f172a","year":2015},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.504222Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:18c8789dac5ab839de17cc68dc9cab149cf26fc18065a5956c87dc706ac433c7","observation_id":"b79813f8-753d-4a16-858a-d011556ba540","resolution":{"observed_at":"2026-08-15T23:16:02.603584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:16:02.584256Z","title":"Searching for MobileNetV3,","venue":null,"work_id":"8e70c33c-c249-415e-adce-110ccccceb85","year":2019},"citing_paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:02.508018Z"},"links":{"citing_paper":"/paper/2505.05223"},"observation_digest":"sha256:df23a4a114b3da8c7fda529ce2a6c48982deb4aafc0c6f102094ecb768786b8e","observation_id":"33ec2fdd-b318-488b-b744-62bb9ab973b4","resolution":{"observed_at":"2026-08-15T23:16:02.589447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.05223","last_updated":"2025-07-18T15:16:10Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-15T23:07:34.867087Z","submitted_at":"2025-05-08T13:16:37Z","title":"Multi-Objective Reinforcement Learning for Adaptable Personalized Autonomous Driving"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":36},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2505.05223."}