{"as_of":"2026-08-08T02:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d0254ca8c8b87563f4d843057d98ce5bdd0afb88861ac4a4e6c5c33934942a60","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:38:36.716242Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T11:34:38.462448Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T02:38:17.343103Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.12977","snapshot_observed_at":"2026-08-06T11:34:38.462448Z","title":"Non-differentiable reward optimization for diffusion- based autonomous motion planning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22615","last_updated":"2025-07-30T12:36:05Z","snapshot_observed_at":"2026-08-06T11:34:37.700417Z","submitted_at":"2025-07-30T12:36:05Z","title":"Generative Active Learning for Long-tail Trajectory Prediction via Controllable Diffusion Model","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T11:34:38.462448Z"},"links":{"cited_paper":"/paper/2507.12977","citing_paper":"/paper/2507.22615"},"observation_digest":"sha256:ad0b5959d6581b1e2b66944775f78696341ad8da420ca92f8f76b6b87e5332a4","observation_id":"9477e58b-7f42-474b-930f-950d54d316e3","resolution":{"observed_at":"2026-08-06T11:34:38.462448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"cited_work":{"arxiv_id":"2507.12977","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12977","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Non-differentiable reward optimization for diffusion-based autonomous motion planning","venue":null,"work_id":"fbfb0121-015e-4c9b-bf82-d66f7923691c","year":2025},"citing_paper":{"arxiv_id":"2604.19267","last_updated":"2026-04-21T09:32:59Z","snapshot_observed_at":"2026-07-06T23:05:58.167533Z","submitted_at":"2026-04-21T09:32:59Z","title":"Multimodal embodiment-aware navigation transformer","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T02:37:50.624886Z"},"links":{"cited_paper":"/paper/2507.12977","citing_paper":"/paper/2604.19267"},"observation_digest":"sha256:9edf188b2bee3bb10a8164bd4f22ccc2eff0dc0198b9ad2a437601ccf6986b91","observation_id":"5e59496e-71a2-4290-a56d-2d6428f439fa","resolution":{"observed_at":"2026-05-10T02:38:17.344445Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.12977/citation-record","integrity":"/paper/2507.12977/integrity","json":"/paper/2507.12977/citation-record.json","paper":"/paper/2507.12977"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:46.979683Z","title":"St-p3: End- to-end vision-based autonomous driving via spatial-temporal feature learning,","venue":null,"work_id":"7444198d-1c9b-4e8c-9abc-e25ae36d6476","year":2022},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:30.038782Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:7b8c37af3e5ccc240929e86d09c07f0b27bc79ee8a7fd92cd446b4c69b179779","observation_id":"faf8fca2-41d8-4109-8203-e470469574af","resolution":{"observed_at":"2026-08-06T16:38:47.150044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:46.724769Z","title":"Per- ceive, predict, and plan: Safe motion planning through interpretable semantic representations,","venue":null,"work_id":"d20f4bd2-60a2-412e-977a-8914ecc9043d","year":2020},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:30.116542Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:838516e4e74e87c44c813ee0cabfe721cc12652e7c0d8665eb9de019e42c8951","observation_id":"c6ab466e-753e-4f9c-a006-8e9635ed060b","resolution":{"observed_at":"2026-08-06T16:38:46.831482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:46.447595Z","title":"Dsdnet: Deep structured self-driving network,","venue":null,"work_id":"028bcb49-3104-4e46-aa9e-01513951fb2b","year":2020},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:30.242568Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:00276d09c24fdc4637a78afd76b1faff48f91da4727eaa9d47b77c94fb79e5fc","observation_id":"66c0482e-4272-4b80-8524-1b3f73df66bc","resolution":{"observed_at":"2026-08-06T16:38:46.581600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:46.214170Z","title":"Multi-modal knowl- edge distillation-based human trajectory forecasting,","venue":null,"work_id":"06debc3b-2c46-4384-8a48-2b4d81848afe","year":2025},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:30.405170Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:351ab49dc6038b2c7b72954175050c5bd4a57a50dd6e882682d7a1230fce3a76","observation_id":"1d7728ca-2930-480e-8e9d-d10de4f472a0","resolution":{"observed_at":"2026-08-06T16:38:46.330651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:45.950466Z","title":"Fast-replanning motion control for non-holonomic vehicles with aborting a*,","venue":null,"work_id":"7d745b01-d343-417e-bde3-c0f6db34d0c4","year":2022},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:30.516413Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:36715d0458371f124d7334a6d2393da5d328ca981af36f65c3308dfe108cd672","observation_id":"e5b3705b-37f2-4c92-bb5a-dc368687b641","resolution":{"observed_at":"2026-08-06T16:38:46.085755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:45.733835Z","title":"Informed rrt*: Optimal sampling-based path planning focused via direct sampling of an admissible ellipsoidal heuristic,","venue":null,"work_id":"9da8189f-01b3-4be7-9832-2ec0df3c0450","year":2014},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:30.672535Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:61446f63b4e2989027b3806fbdcb01dd104c91745bea02788ec9bc47a02ca9ee","observation_id":"22693db8-4841-4acb-8402-031293c46cf0","resolution":{"observed_at":"2026-08-06T16:38:45.826865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:45.568984Z","title":"Path planning using neural a* search,","venue":null,"work_id":"df207a1f-cae8-42c0-8283-8e525f976e45","year":2021},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:30.823754Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:08ff6c5375602a364a85cb26b1db1bd407f323c37c7e9a12ae5b73ccce133af3","observation_id":"7c348d81-fff9-49f8-842a-7c9e1a1ed09e","resolution":{"observed_at":"2026-08-06T16:38:45.632277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:30.938700Z","title":"Sampling-based algorithms for optimal motion planning,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:30.938700Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:dc84e937cb8b8722e358491a55cab7f447f916c542364cd043477a94a78efaff","observation_id":"a6c96eca-9795-4be6-a548-d90b8f389437","resolution":{"observed_at":"2026-08-06T16:38:30.938700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:45.350662Z","title":"Deep imitation learning for autonomous driving in generic urban scenarios with enhanced safety,","venue":null,"work_id":"5d6ca208-564d-478f-894e-7b0dfd9a985f","year":2019},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:31.065718Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:bd4b9bea62408da5f2194afda23b7fc7619eb454bea057ebdfed17bcd78bc65b","observation_id":"96472994-1514-49d9-b45a-517e6eb99ca2","resolution":{"observed_at":"2026-08-06T16:38:45.440891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:45.076358Z","title":"Safe reinforcement learning with stability guarantee for motion planning of autonomous vehicles,","venue":null,"work_id":"84726b1c-c68d-43d4-9b52-cedd16a91865","year":2021},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:31.176073Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:be9cb5df2a7c102710378989b3ca823d1f9a9b5f93c382095e51db24ca35f9c7","observation_id":"dd7a703f-1053-4687-8ca0-bb91cc1921d0","resolution":{"observed_at":"2026-08-06T16:38:45.213239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:44.886987Z","title":"Parting with misconceptions about learning-based vehicle motion planning,","venue":null,"work_id":"01361247-6d25-47b4-b191-a4490764883f","year":2023},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:31.336254Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:7ff82ec7417a427168ef2535c81333c749fcee8e6d582e21d26c2cbb7b7ba6d7","observation_id":"233752d2-440c-4f18-9d56-686eea03e744","resolution":{"observed_at":"2026-08-06T16:38:44.980803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11796","last_updated":"2023-08-28T09:00:50Z","snapshot_observed_at":"2026-07-06T14:08:37.178824Z","submitted_at":"2022-10-21T08:19:45Z","title":"Differentiable Constrained Imitation Learning for Robot Motion Planning and Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11796","snapshot_observed_at":"2026-08-06T16:38:31.433701Z","title":"Dif- ferentiable constrained imitation learning for robot motion planning and control,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:31.433701Z"},"links":{"cited_paper":"/paper/2210.11796","citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:d7f4937e66e14e9c7566b009ce6458d1e273f68cf3731c30ff1dce9f1fd5f5dc","observation_id":"424207c6-bbf6-45dd-9d4e-f28c123a3bde","resolution":{"observed_at":"2026-08-06T16:38:31.433701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:44.643514Z","title":"Diffusion-es: Gradient-free planning with diffusion for autonomous and instruction-guided driving,","venue":null,"work_id":"28479cb2-2b1b-44a5-b72c-afc17a7bde8d","year":2024},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:31.584764Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:1c35740d58f16f809b53ed26faa22f8c3551bb917b5fbefa2231038fa5e46413","observation_id":"71c2c8ac-a34f-407b-bbaf-910628542620","resolution":{"observed_at":"2026-08-06T16:38:44.782389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:44.449398Z","title":"Motiondiffuser: Controllable multi-agent motion prediction using diffusion,","venue":null,"work_id":"e7800dc2-389f-44f5-9594-fb030fd6cb76","year":2023},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:31.696711Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:632b93eda865d93c6419075e6773570a9f77a1f4827e6cc5756235d5f3ec5afd","observation_id":"f4136118-a487-43f7-8e4d-7c557a609ca7","resolution":{"observed_at":"2026-08-06T16:38:44.543937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:31.813252Z","title":"Diffusion models beat gans on image synthesis,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:31.813252Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:152c768b930726dc866fcff665492033db2ffc64b373d36032b573be3faab221","observation_id":"56940f92-5fd7-4254-8b75-aed2a20daac9","resolution":{"observed_at":"2026-08-06T16:38:31.813252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:44.086730Z","title":"Language-guided traffic simulation via scene-level diffu- sion,","venue":null,"work_id":"2057120c-3333-4f96-9daa-e62effb82e90","year":2023},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:31.960323Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:073982c88db2c2580cc23ad12407642a9d0feb95c8dcc85e7ee1fc44231c93a6","observation_id":"ce492428-58aa-4220-8a1b-5977589a9920","resolution":{"observed_at":"2026-08-06T16:38:44.267630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:43.830847Z","title":"Safe-sim: Safety-critical closed-loop traffic simulation with diffusion- controllable adversaries,","venue":null,"work_id":"be82a50e-0b79-4e41-a0de-7044b8b6dc3b","year":2025},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:32.094513Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:26daf8636e2e16cf0bf0b37c91b80603bcb89c20c31737aa673f6bd73bacc825","observation_id":"d1e7c7ef-8d61-4728-8256-36fc0c2fa831","resolution":{"observed_at":"2026-08-06T16:38:43.946422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19279","last_updated":"2024-03-28T10:02:10Z","snapshot_observed_at":"2026-07-06T17:52:26.380307Z","submitted_at":"2024-03-28T10:02:10Z","title":"Fine-Tuning Language Models with Reward Learning on Policy","version":1},"cited_work":{"arxiv_id":"2403.19279","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.19279","snapshot_observed_at":"2026-08-06T16:38:37.065338Z","title":"Fine-Tuning Language Models with Reward Learning on Policy","venue":"cs.CL","work_id":"2f0b6672-3e93-4e92-9b92-6e38f0308128","year":2024},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:32.272467Z"},"links":{"cited_paper":"/paper/2403.19279","citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:9dabb9daf5cdc2b164a0f261f74af36b2bbbec630579874bdcb6e674dfc161f5","observation_id":"40bb854f-01ac-48bd-aa67-351e05df5eba","resolution":{"observed_at":"2026-08-06T16:38:37.143823Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:43.527640Z","title":"Training diffusion models with reinforcement learning,","venue":null,"work_id":"0f0ce114-c9f0-46ed-8380-65c844409972","year":2024},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:32.426350Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:79b262941574e1f9ec1066c6152ba7a609e308610a70c485552691984194c980","observation_id":"1404fe10-6cb0-471d-8729-1f59112944bf","resolution":{"observed_at":"2026-08-06T16:38:43.624323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:32.615647Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:32.615647Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:cc0fcffb83ea64b0a904907003a8b4d2fb967ecc855c8ef3c83bf476670a65d6","observation_id":"e3af2e56-e04b-48c8-9eb3-fed313891c33","resolution":{"observed_at":"2026-08-06T16:38:32.615647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:43.219747Z","title":"Improved denoising diffusion prob- abilistic models,","venue":null,"work_id":"8aee1ae1-ac42-445f-b962-698838318e01","year":2021},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:32.731481Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:03551e78c29628caa2062f6f3309c73966753e7040aabb5c9ded5f933890cfce","observation_id":"a0861cf5-8a3e-4acf-b34c-0c0acbb43bd0","resolution":{"observed_at":"2026-08-06T16:38:43.355616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:42.892973Z","title":"Improving transferability for cross- domain trajectory prediction via neural stochastic differential equa- tion,","venue":null,"work_id":"988329f5-b209-475e-b952-10fae7750684","year":2024},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:32.880110Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:68a891d687892fa2d88964e6a38e78b3e0a2be5acf84d179e9aa318e12bee51c","observation_id":"6ad6cba7-d1f8-492e-bf7c-8418c0efb21a","resolution":{"observed_at":"2026-08-06T16:38:43.044648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:42.641130Z","title":"Maximum likelihood training of score-based diffusion models,","venue":null,"work_id":"db9b8c7c-6f0b-4c6f-a7e2-33b8b3b84f83","year":2021},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:33.044271Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:16ba2b29ae5051f55be2329840a918ce17b1665a386c20268b8ba5c7db8eaa9a","observation_id":"92f19643-57e4-4231-b71d-872aeed50c45","resolution":{"observed_at":"2026-08-06T16:38:42.756492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04809","last_updated":"2024-10-07T07:42:59Z","snapshot_observed_at":"2026-07-06T19:28:52.383175Z","submitted_at":"2024-10-07T07:42:59Z","title":"Data-driven Diffusion Models for Enhancing Safety in Autonomous Vehicle Traffic Simulations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04809","snapshot_observed_at":"2026-08-06T16:38:33.177376Z","title":"Data-driven diffusion models for enhancing safety in autonomous vehicle traffic simulations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:33.177376Z"},"links":{"cited_paper":"/paper/2410.04809","citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:5d8c9b428c2edd118cb4abb70b147e253a7bf7934073a66f2859386a26d68dfe","observation_id":"022fdce8-2253-41df-84a9-a17987f66f26","resolution":{"observed_at":"2026-08-06T16:38:33.177376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.09991","last_updated":"2022-12-21T01:06:18Z","snapshot_observed_at":"2026-08-06T05:32:02.292779Z","submitted_at":"2022-05-20T07:02:03Z","title":"Planning with Diffusion for Flexible Behavior Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.09991","snapshot_observed_at":"2026-08-06T16:38:33.283453Z","title":"Plan- ning with diffusion for flexible behavior synthesis,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:33.283453Z"},"links":{"cited_paper":"/paper/2205.09991","citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:9c0ab0ae073bee759c2ca375c417fe504040f564d0c34babb4c7c61d606f80ce","observation_id":"5f04bf3a-a7c5-4256-b534-67cd80d675f5","resolution":{"observed_at":"2026-08-06T16:38:33.283453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:42.371138Z","title":"Leveraging future relationship reasoning for vehicle trajectory prediction,","venue":null,"work_id":"03f07dee-690b-44c0-99dd-686220b614dc","year":2023},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:33.400990Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:2e6b81b205d452bde98e1dbd34a88dedc0a9cc39905d0494afaf8cac443f00ca","observation_id":"5a0a298e-080c-43fa-95ac-a15f4603fb61","resolution":{"observed_at":"2026-08-06T16:38:42.507763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:33.539006Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:33.539006Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:03215a054e6f60948e66a82898ebe5ee3b39f1dc15043ba872b325ff38f25bf0","observation_id":"4dc59fa4-4fac-47b7-9879-ccd76c0ca9fd","resolution":{"observed_at":"2026-08-06T16:38:33.539006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:42.047819Z","title":"Human-level control through deep reinforcement learning,","venue":null,"work_id":"e36788e6-e724-433e-811a-5ceec064c67e","year":2015},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:33.686261Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:a768606f6319cb1b7be786006c75f62a07b342f872293873ead6d94ea6d53b75","observation_id":"697deb55-7215-4d23-aa20-cd32d652cc1d","resolution":{"observed_at":"2026-08-06T16:38:42.194764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:33.811079Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:33.811079Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:603bf36eb7965e0f3e0d0182066abe1c805ab1f2ec2f90715d798667a701c951","observation_id":"bd6870bd-9931-4757-b50a-81e8076a8731","resolution":{"observed_at":"2026-08-06T16:38:33.811079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:33.928478Z","title":"A markovian decision process,","venue":null,"work_id":null,"year":1957},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:33.928478Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:d047760d95e72fec604e72d85ea9e2b981253fa512cfb7d0c56d7a459e1e12bf","observation_id":"a9ef963a-46d0-4348-8568-0c152cea7b0d","resolution":{"observed_at":"2026-08-06T16:38:33.928478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:41.698934Z","title":"Deterministic policy gradient algorithms,","venue":null,"work_id":"645aad43-65fb-493a-96d2-8a4906fe3cd7","year":2014},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:34.055208Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:8c57652afe7b842e05558a7a017aefbd75252b41c3350146e1f4bcb26bfdebef","observation_id":"65ec2c56-ae69-4d0d-b0d5-efac8f5567b4","resolution":{"observed_at":"2026-08-06T16:38:41.817679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:41.358779Z","title":"Comprehensive reactive safety: No need for a trajectory if you have a strategy,","venue":null,"work_id":"03957c29-a4dd-4ab6-ba25-3a3301bdac49","year":2022},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:34.275662Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:204642883e2aea8e5e0002d678e0a81d5e9b53e94ade807fadbae88c386b249c","observation_id":"e1163659-b9b2-4450-8d61-959a4728aaa3","resolution":{"observed_at":"2026-08-06T16:38:41.510705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:41.028276Z","title":"Autonomous driving motion planning with constrained iterative lqr,","venue":null,"work_id":"4595da2f-1137-4d70-9d84-e4b7fe1eefd1","year":2019},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:34.388940Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:b271be89e354a237f3f45ca9d004366f2a20e200f8ef8b90c9ec315b8f2a34b0","observation_id":"43a29ff3-811f-40de-8e6a-cacfe5926601","resolution":{"observed_at":"2026-08-06T16:38:41.216894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:40.735746Z","title":"Leader: Learning attention over driving behaviors for planning under uncertainty,","venue":null,"work_id":"78368772-8958-437a-9ee2-07d6d6a66745","year":2023},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:34.495658Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:31d62043027708c3088ae9d762799222742d3f6f8b9f58cb80136b3a321dd1e6","observation_id":"e57640ad-2962-4086-b6e5-013ec4440039","resolution":{"observed_at":"2026-08-06T16:38:40.876894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:40.506365Z","title":"Kb-tree: Learnable and continuous monte- carlo tree search for autonomous driving planning,","venue":null,"work_id":"ff631835-d43c-439b-b6c4-e1f7dd74763e","year":2021},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:34.660594Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:e4bc570aac0950687c53b81befe9fd7c17490da33224241554c804927ce0b954","observation_id":"4e2ae681-4809-4b72-8e39-20da45b38e36","resolution":{"observed_at":"2026-08-06T16:38:40.618371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:40.181650Z","title":"Driving maneuvers prediction based autonomous driving control by deep monte carlo tree search,","venue":null,"work_id":"3b80d97f-2cb2-44d3-91c7-bbc6fb307b63","year":2020},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:34.837308Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:31677c52ae517b2868a657e2c551f108c422031f8e0e533310c2418afdd8a42a","observation_id":"cc8420a6-6c07-47f9-9e84-c42e8b3b83ea","resolution":{"observed_at":"2026-08-06T16:38:40.307644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:39.927081Z","title":"Crowd-robot interaction: Crowd-aware robot navigation with attention-based deep reinforce- ment learning,","venue":null,"work_id":"d2620f3b-797c-4afe-ae9f-183b180ed346","year":2019},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:35.004659Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:488204553b053917c862c0dd596ed700e6b3e1ce7f79429fe490a0ab037806ad","observation_id":"5a5bd1f6-1ae4-48ce-8f39-3ec7acbff972","resolution":{"observed_at":"2026-08-06T16:38:40.057558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:39.638719Z","title":"Rethinking closed-loop training for autonomous driving,","venue":null,"work_id":"5fa1f3fa-2bdd-4f2b-8620-b9306314fd0a","year":2022},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:35.175208Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:845625fa0dad04b695172333f9773e1e2a4e5915dbb7c4a1054edcefc865a0ca","observation_id":"2426f62b-00e3-43c9-bb91-ba36bea1ced6","resolution":{"observed_at":"2026-08-06T16:38:39.793267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.11097","last_updated":"2022-06-28T09:54:03Z","snapshot_observed_at":"2026-07-06T12:10:46.147640Z","submitted_at":"2021-11-22T10:37:52Z","title":"UMBRELLA: Uncertainty-Aware Model-Based Offline Reinforcement Learning Leveraging Planning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.11097","snapshot_observed_at":"2026-08-06T16:38:35.279970Z","title":"Umbrella: Uncertainty-aware model-based offline reinforcement learning leveraging planning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:35.279970Z"},"links":{"cited_paper":"/paper/2111.11097","citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:bc8623066657232b781bd676ececec4bbbeab599a988d64c2604bd5bbe40ac64","observation_id":"cfa90fd5-bbc6-4a6f-ab0d-a081db8ea412","resolution":{"observed_at":"2026-08-06T16:38:35.279970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.00374","last_updated":"2024-04-03T14:26:32Z","snapshot_observed_at":"2026-08-07T15:39:37.899352Z","submitted_at":"2019-03-01T15:40:19Z","title":"Model-Based Reinforcement Learning for Atari","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.00374","snapshot_observed_at":"2026-08-06T16:38:35.402897Z","title":"Model-based reinforcement learning for atari,","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:35.402897Z"},"links":{"cited_paper":"/paper/1903.00374","citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:723e1e18f07b929d6cef6669b2964e6237135cbd037910711d9861fe14590cb2","observation_id":"5480b033-6841-4eb0-8a9e-36d72bf2e98d","resolution":{"observed_at":"2026-08-06T16:38:35.402897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:39.351505Z","title":"Approximately optimal approximate reinforcement learning,","venue":null,"work_id":"bcd22100-986b-4814-8a40-ad888fd648c5","year":2002},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:35.558259Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:ce792cd541093a959a2029491a4d800a83f1241d3f2ff1243f66cf3ef32a55d7","observation_id":"e4b71ebc-b3b0-4a22-97d6-0684ffe7abb5","resolution":{"observed_at":"2026-08-06T16:38:39.465099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-06T16:38:35.692097Z","title":"High- dimensional continuous control using generalized advantage estima- tion,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:35.692097Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:409dfe78c0df4c19e0bd33991fc877d9e808fe0bad123c8e0ce7d7b2377332de","observation_id":"cfc50aff-d961-484a-8a3a-33a276314092","resolution":{"observed_at":"2026-08-06T16:38:35.692097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:39.061959Z","title":"You’ll never walk alone: Modeling social behavior for multi-target tracking,","venue":null,"work_id":"40ba2cbe-af8f-49e9-867c-a15f0d88e03b","year":2009},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:35.873363Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:fa04cca498a15d5bb0edad72b9d5fbcbeb6cf2270b8f89ac65c919e06591b363","observation_id":"8bee159c-9eb9-454b-ab7e-b295b75b1d86","resolution":{"observed_at":"2026-08-06T16:38:39.188418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:38.755477Z","title":"Crowds by example,","venue":null,"work_id":"b25b4569-ea4d-4ee6-af88-737915a4159e","year":2007},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:36.019114Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:2a85001c48f8166feab929004257dc597778868f7005719263087c6126c48651","observation_id":"b87a31c1-40b2-4398-9c5b-dc162035a206","resolution":{"observed_at":"2026-08-06T16:38:38.877846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:38.483956Z","title":"A game-theoretic framework for joint forecasting and planning,","venue":null,"work_id":"3fcd0e2e-4970-4f77-8f36-ed4e691cff63","year":2023},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:36.142468Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:fc6edcc6d06c6e5610a4fbbaf8327f96dadc712064173c69c367d195e12cabdb","observation_id":"fbb7d610-3bb4-4584-8ab6-f7114cbe6d42","resolution":{"observed_at":"2026-08-06T16:38:38.596213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:38.243634Z","title":"Human trajectory prediction via neural social physics,","venue":null,"work_id":"dc96a1be-fb5f-4a03-a5d9-d2c92ca699de","year":2022},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:36.311109Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:936892a2f9d3e15d57bda1160e15ae8cf447ff4789d4f7c83b4261a4cf5ed00a","observation_id":"a8c5f799-b57f-4978-a72f-d43ba4163ddf","resolution":{"observed_at":"2026-08-06T16:38:38.346033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:37.942743Z","title":"Dtpp: Differentiable joint conditional prediction and cost evaluation for tree policy planning in autonomous driving,","venue":null,"work_id":"974b0036-7eab-4854-9ba2-46f9f22dba5f","year":2024},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:36.450342Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:28e3d51376201968fae7643f382fbdcf3e6c43cf4a7c542f0f084ae25980d5f0","observation_id":"36f629b8-3a35-4601-9aa3-1289bb3193c4","resolution":{"observed_at":"2026-08-06T16:38:38.084375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:37.678610Z","title":"Differentiable integrated motion prediction and planning with learnable cost function for autonomous driving,","venue":null,"work_id":"67ba94b5-98af-4369-b492-660c3a408a0a","year":2023},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:36.598662Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:2b6f410110ab47048087154a5eb46d3927435b3908e2615d74ceca22953e8f94","observation_id":"18d390bf-2c40-41fc-9771-baac2345d6b5","resolution":{"observed_at":"2026-08-06T16:38:37.809300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:38:37.376921Z","title":"Stochastic trajectory prediction via motion indeterminacy diffusion,","venue":null,"work_id":"99f50f3f-f45b-43e5-9801-a20bdc7ad89c","year":2022},"citing_paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T16:38:36.716242Z"},"links":{"citing_paper":"/paper/2507.12977"},"observation_digest":"sha256:5adbc24d74f3e0b0ec971e41ed901bf9794c8989d5399d92bead9544a25cf305","observation_id":"1bbfc78a-f87f-4e42-a868-01890a07cac1","resolution":{"observed_at":"2026-08-06T16:38:37.526520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.12977","last_updated":"2025-07-17T10:26:06Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-06T16:31:05.348541Z","submitted_at":"2025-07-17T10:26:06Z","title":"Non-differentiable Reward Optimization for Diffusion-based Autonomous Motion Planning"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":1,"verified_fuzzy":36},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 2 inbound Pith citation observations for arXiv:2507.12977."}