{"as_of":"2026-08-10T15:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6e5ed5cb3fb497df1be5f9577c27c1b73be66bcd75119fde465fccb73008450b","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T09:22:16.530780Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.05064/citation-record","integrity":"/paper/2607.05064/integrity","json":"/paper/2607.05064/citation-record.json","paper":"/paper/2607.05064"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"Science , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:0f0657186b6f920504ea646c5e6e25358fda1c5553f86bb61e1f5739e58a1c4a","observation_id":"ede356fc-1413-4ad2-9623-fc9f2008bdc3","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.06680","last_updated":"2019-12-13T19:56:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-12-13T19:56:40Z","title":"Dota 2 with Large Scale Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.06680","snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"arXiv preprint arXiv:1912.06680 , year =","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"cited_paper":"/paper/1912.06680","citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:a998a7275fc475cbb95b27d32e1ae93a1156b4454eac5582904abbbaea8921fe","observation_id":"ebf3cdda-fb71-4eff-a9e4-19d1fb9880c9","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"Proceedings of the 35th International Conference on Machine Learning (ICML) , series =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:9798fa482580e25c76608b9bf111e0a40c9628e359efe05c0f738e3a71d16968","observation_id":"5ce4d2a7-f07a-4975-852a-32569b19f783","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"Nature , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:5a901662c3dd95111f196688862a608cfb1a1af0f17a21caedca66081fb061d0","observation_id":"ae12b3f3-83f0-4c75-befc-2adcf04205c9","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"Machine Learning , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:6909c610e60ff74c9fdfa3a25e8e19a64ceee6980f4411dcd69bcd5b27b6180b","observation_id":"bdc1f713-c346-414c-8c22-d1565d1d0153","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"Journal of Financial Markets , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:f226c633cefbd1cb35fd28c0e37dd2fa679b461c86e0b3877749a7a47f98b884","observation_id":"721c6a17-ea3a-4b74-9334-08d52fe518fe","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:ee2c058e789e35aeb161752cebe38b95487754dd8ffe2b64fec94c85f368c1e0","observation_id":"2a44cd91-9e46-4ddf-b357-ab671f12761f","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"2003 , note =","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:9319b139c67417d9469ccd182dac21000c6e45966af17f4f2437044c7bdccf5f","observation_id":"6ddd9ddf-ea63-48b0-ba8a-e96d0872cb83","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"2018 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) , pages =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:ba97e85f4f599f3416934ab9925f3b7f85a918a428d721cb976069e391ffee11","observation_id":"92ad440d-84e8-4a09-a897-1c557f8e5ea2","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"IEEE Transactions on Automatic Control , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:8c711bb2103f3963cd4a1ab4e9168f74a1383dba1715d709ba5d64e2c6967385","observation_id":"3b222385-8ddf-40f0-8a82-b47fd9eedec3","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"Proceedings of the 1992 ACM SIGMETRICS Conference on Measurement and Modeling of Computer Systems , pages =","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:d50275fbdee7c7d6d2d5e196153ab1cfe8c81d1d07709a8ba982ccba5c7cd27b","observation_id":"e814054d-6b59-463c-b625-cf0e7316f3b3","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:75e8d771fbb49427d883fb24b0135963f5384f4256248e444e7166cb83f4123d","observation_id":"81993e90-4d0d-49e9-8835-b16b8e291b1c","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"Autonomous Agents and Multi-Agent Systems , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:3102ac095af3233193019395b5c8d3c023dbb58bfe527a6e8bc81844fc950f5c","observation_id":"3ab004bc-06d7-484a-985d-7968a689b28d","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.07286","last_updated":"2018-10-16T21:36:35Z","snapshot_observed_at":"2026-08-07T07:18:25.021813Z","submitted_at":"2018-10-16T21:36:35Z","title":"At Human Speed: Deep Reinforcement Learning with Action Delay","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.07286","snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"arXiv preprint arXiv:1810.07286 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"cited_paper":"/paper/1810.07286","citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:933390dabbc63ef622c5e6007e83c4c97846b9a571daca067b1f22e7431da425","observation_id":"dcfcfd05-e8b5-4324-bf2e-da930c896d34","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"Proceedings of the International Conference on Automated Planning and Scheduling (ICAPS) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:f46f0ce856b9a54985525ec556db37166ea88ed89367203ca0d2cba09523c574","observation_id":"5042b2da-af2b-4ac7-ac52-b38a80e9183d","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"ICLR , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:6b18799b747382e557183054126acdbce270b3d874bfa190dfa62bbb3f2f63b0","observation_id":"9dbf1753-53df-40d4-8129-afb660d6e68e","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"Proceedings of the 30th ACM International Conference on Information & Knowledge Management (CIKM) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:a3e7e61789c824912a98d103e547b878072eae2c1463a8023838b0895cbd764d","observation_id":"c5f3e414-f3ac-4c35-8127-bf0535b1c4f5","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"International Conference on Learning Representations (ICLR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:f4aa3671cb576d5cefab5f6e9434f3b4cade3397e89cee9e3d601097787b26df","observation_id":"34d25e7a-cb5d-4252-947c-ad7412b1c7fb","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"International Joint Conference on Neural Networks (IJCNN) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:c115cb3fea289ec4ae7764cc633c6e1ab0351b744b027681d048481864bcdd69","observation_id":"776753ef-584d-472a-a69c-b7bef9fad58d","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03141","last_updated":"2024-06-05T19:12:37Z","snapshot_observed_at":"2026-08-05T15:59:19.985354Z","submitted_at":"2024-02-05T16:11:03Z","title":"Boosting Reinforcement Learning with Strongly Delayed Feedback Through Auxiliary Short Delays","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03141","snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"arXiv preprint arXiv:2402.03141 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"cited_paper":"/paper/2402.03141","citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:93def5b271db393f6b076e28285fcab90189c4a2a9f3006f181a728f14014004","observation_id":"2babf0ac-51a9-4b88-84ad-9d60e44f8d7d","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.12901","last_updated":"2019-04-29T18:40:15Z","snapshot_observed_at":"2026-07-06T07:49:17.886466Z","submitted_at":"2019-04-29T18:40:15Z","title":"Challenges of Real-World Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.12901","snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"arXiv preprint arXiv:1904.12901 , year =","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"cited_paper":"/paper/1904.12901","citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:0c2ac07c2b8afcd394472d2e85d66e37da32170fe241388addbeea791ea199ac","observation_id":"3c57fe15-a109-4180-8a87-8bb4a5093ef0","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"2010 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) , pages =","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:73fb77902eed516d1b1ede847655a97dd65ea643caf54f0e1e77ef60fd084e61","observation_id":"b92d9be7-2725-4940-ad95-9cba600efbfd","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"Autonomous Agents and Multi-Agent Systems , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:820cbe3f2882947b0c310642729525c270df4ac985777cc35602b8fd9ea0bf00","observation_id":"5a21442b-2109-4758-8937-54c4d1aaf1b6","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"2021 International Joint Conference on Neural Networks (IJCNN) , pages =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:6c6892778f1daab290e2bf46a00ad2839e8a1c363be8a7d6791d4d0e80de6206","observation_id":"dbe3dc11-46f3-464c-bc20-ee33ffde4c3c","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"Neurocomputing , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:e13538a98c3e54b667caad310a4d4c9f6e93f17b61dd5c22e9d0f81a011d6522","observation_id":"12c60d2b-f6e3-4d0b-941e-7cd2a98dfe3e","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:a8155cf788980ad7f32e4f38d35b74562ea9bb4818663a0f11ab95b0dde8fda3","observation_id":"25b2ef6b-5d9d-4065-ae8d-23a5daebb84e","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"International Conference on Learning Representations (ICLR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:184797816c14d6c32524f5ee3d9b1696f5aa0e5e258085115db6a390f74132ea","observation_id":"11fc8660-4f0a-4c96-a03f-dc278c4c5896","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"International Conference on Machine Learning (ICML) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:f0b3c957e7df4ce90d016f5132e094cc6962ef4742e7d3d00b17843b42f70664","observation_id":"58fbcf23-8b44-43b6-9df0-7d024e66c426","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03102","last_updated":"2024-06-05T09:45:26Z","snapshot_observed_at":"2026-07-06T18:25:44.620682Z","submitted_at":"2024-06-05T09:45:26Z","title":"DEER: A Delay-Resilient Framework for Reinforcement Learning with Variable Delays","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03102","snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"arXiv preprint arXiv:2406.03102 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"cited_paper":"/paper/2406.03102","citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:24a8a5399cea8afcf8581dc9daae75425410ea183037467d7f7d544ed3da2b7c","observation_id":"edb99f8b-0d84-40ee-82c5-2deeb47ed08b","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"arXiv preprint arXiv:2507.18992 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:3333842b9785caf30889b4b45d3a57750e306990751d192e6dd8aa2945c92a2d","observation_id":"0c88fec7-10f2-4452-ac49-69c629ddc43e","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"International Conference on Machine Learning (ICML) , pages =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:e18b8a4956e850004ce7504db26af9a4bd2686db94fda44e81c4115a729584eb","observation_id":"74461b9b-923d-40bf-a242-81dd7010d6f3","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:e22ae8854c8181ede81e6a43311da927f2b8663e524780b087cc80c8c94b48a7","observation_id":"6021b6db-eb73-4e01-a652-c68db58c1f6b","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"Advances in Neural Information Processing Systems (NeurIPS) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:caa0a84f9b20668e70272ef4cf22702a5c0569d27ffa4ddeec63a4eef097bd4b","observation_id":"c0423553-02cc-477c-9836-1af6d205bbcb","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"International Conference on Learning Representations (ICLR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:00c4b55cd0dee1f70a9e1f58b7bbe53baf91a6eaf64fc17fe59dce3ee97da427","observation_id":"6c8555a3-4d03-48d3-9773-a8cbde4fda14","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"Artificial Intelligence , volume =","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:92fdad0c2125fb7d5cf434d2881960cc7d7f3c07667a67d4174b2967ea7ee09d","observation_id":"6d565b5d-aff3-48d9-a186-b756486e17a5","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"Denoising Diffusion Probabilistic Models , booktitle =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:e775e7a89ebe10c2fdc46b4b3ccd8d9a2fc7de775cb6d12a15186d28fd013f70","observation_id":"a0348ed8-70c9-44da-8ada-b291b386d915","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"Diffusion Models Beat GANs on Image Synthesis , booktitle =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:d9b8bb58b871948977104cee3ddf79649986f2fa48e09f0c50fc8ca589306d88","observation_id":"a50a7cfc-aac4-4915-9bd0-4c0ca454c4dc","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"Proceedings of the 38th International Conference on Machine Learning (ICML) , series =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:0d6ca5b06d6a26090370339944de287ae564dd95b522444960e3e86a6e827cff","observation_id":"f1d10200-c0e6-4b81-8661-a093b159eb7e","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T09:22:16.530780Z","title":"2012 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) , year =","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-07-11T09:22:16.530780Z"},"links":{"citing_paper":"/paper/2607.05064"},"observation_digest":"sha256:d1c89bd00ebb7ea83519fc593bf0331cd99f605c36e173dac0ad0f56ac77f066","observation_id":"1a7c2090-d998-4e28-b865-c1284bda435c","resolution":{"observed_at":"2026-07-11T09:22:16.530780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.05064","last_updated":"2026-07-06T13:33:17Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-09T13:19:18.454573Z","submitted_at":"2026-07-06T13:33:17Z","title":"Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2607.05064."}