{"as_of":"2026-08-08T20:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e8b23e9092ec5d1a75a45f1c0c0c2678e5a88f7078873cea7232c360f0005374","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T23:23:38.957539Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2511.06229/citation-record","integrity":"/paper/2511.06229/integrity","json":"/paper/2511.06229/citation-record.json","paper":"/paper/2511.06229"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:32.683612Z","title":"Diakaki, V","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:32.683612Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:32a5a5c4edfe6a778b637c05a277caed49499c3defe8ce33f9504cd5e3874aa0","observation_id":"0e82afcd-6d6d-48cb-95f1-99bf8e8e4d0b","resolution":{"observed_at":"2026-08-03T23:23:32.683612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:32.753107Z","title":"Li, and J","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:32.753107Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:a4c88fc2a75fbde39ad8694ed74f04b0703dff420c9da6c56982ccfa21b5c7fc","observation_id":"677ce0e9-a148-4977-be2f-048be66e4ec7","resolution":{"observed_at":"2026-08-03T23:23:32.753107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:32.833345Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:32.833345Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:db9d6166a1d35afdafd3ddca3fd68dd52d40cf004d7c21c24b8a0ebd3af67751","observation_id":"e5fee026-0986-460d-8618-bb1ce2f4fd26","resolution":{"observed_at":"2026-08-03T23:23:32.833345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:32.957739Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:32.957739Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:7310f079be81e00c5b43b680f635000b802e64efc0813332befad0ea34624758","observation_id":"0d7bf459-9bf5-4494-abf7-e84f6810ab12","resolution":{"observed_at":"2026-08-03T23:23:32.957739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:33.074591Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:33.074591Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:32c1de354a7fab6a018a5fc2c2418bb098524d338569b143bb7b012fa01c9bc3","observation_id":"222b3e58-b069-4a3f-83f2-f063585c9a79","resolution":{"observed_at":"2026-08-03T23:23:33.074591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:33.198379Z","title":"Markou, and C","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:33.198379Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:b12a3fd953e833b3c78febdb972b4741b2be6d06406f436094f100646bb3592d","observation_id":"5fb3a231-b8ae-4d04-902c-e9b5b45eb3e8","resolution":{"observed_at":"2026-08-03T23:23:33.198379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:33.355980Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:33.355980Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:dd79dc66cb62632809cecf3474ed411a2f5d615f9417ba83e71fdba047a4c5c0","observation_id":"dd10f324-50f3-4517-b3c7-a10ee41de6da","resolution":{"observed_at":"2026-08-03T23:23:33.355980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:33.463976Z","title":"Dynamic Origin–Destination Matrix Calibration for Large-Scale Network Simulators.Transportation Research Part C: Emerging Technologies, 2019a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:33.463976Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:1141897057e2efd71aa1d64b3b9178f1f80987aa8caab33ef7b48c471d4fbf50","observation_id":"0b67dae1-1c11-4342-a5f5-544c37c5ac69","resolution":{"observed_at":"2026-08-03T23:23:33.463976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:33.559574Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:33.559574Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:c074baa25996938a035f8330067ff017d042fe755654307d4a81aa0c2896580c","observation_id":"950d9374-2b48-4712-808f-ea91ef050569","resolution":{"observed_at":"2026-08-03T23:23:33.559574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:33.781959Z","title":"Sasaki, Y","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:33.781959Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:460d7a996491d2d847a483aa54cd57a27ad308bfeb5e98dbf3bd79f2cfa7d9f5","observation_id":"4b0b6997-87b5-4862-ada7-b4cae3b74b91","resolution":{"observed_at":"2026-08-03T23:23:33.781959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:33.901818Z","title":null,"venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:33.901818Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:bf79dabe184a0d51e06b2594af8c23b7abeb83cf3e68920048377c6ac2ef25e4","observation_id":"d0508538-dc7e-43d9-8887-f716a82ce8ca","resolution":{"observed_at":"2026-08-03T23:23:33.901818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:34.022007Z","title":"Montero, J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:34.022007Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:a8e62d64e6d966166798fae04fefea2e6723c9928477aff77fd028c37e67bdca","observation_id":"e3475b7a-4eb2-4056-a88f-63b30d2b56f0","resolution":{"observed_at":"2026-08-03T23:23:34.022007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:34.102592Z","title":"Antoniou, M","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:34.102592Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:37f9072a510c6b67a4b41c10e252e97c3db6734dde6c4bddfb0e901902d77330","observation_id":"ac029355-c2e1-41e5-a391-e269211abf9d","resolution":{"observed_at":"2026-08-03T23:23:34.102592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:34.295251Z","title":"Osorio.Efficient Offline Calibration of Ori- gin–Destination (Demand) for Large-Scale Stochastic Traffic Models","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:34.295251Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:40946fe1d2c571f12412b6ebc820c8fc738f9737c77bbdca06568865e88e4207","observation_id":"00b0058d-2073-49a2-8db4-fef59dc802eb","resolution":{"observed_at":"2026-08-03T23:23:34.295251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:34.495701Z","title":"Kesting.Traffic Flow Dynamics","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:34.495701Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:af13d3dc828d13456626e5baee60000d8278d66eae8894c506b09670c4172f07","observation_id":"5f2bb943-9c49-441c-8755-6c471ed344a0","resolution":{"observed_at":"2026-08-03T23:23:34.495701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:34.701459Z","title":"Steps toward Artificial Intelligence.Proceedings of the IRE, 1961","venue":null,"work_id":null,"year":1961},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:34.701459Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:4e32f1a2ed186be31efd5fad150eb7b93a11d36fbfc2200afb9fde6dce899c22","observation_id":"32b48692-4065-46df-9ab0-7afd4100d08a","resolution":{"observed_at":"2026-08-03T23:23:34.701459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01072","last_updated":"2024-07-04T09:32:18Z","snapshot_observed_at":"2026-08-06T05:10:41.210993Z","submitted_at":"2023-12-02T08:49:51Z","title":"A Survey of Temporal Credit Assignment in Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.01072","snapshot_observed_at":"2026-08-03T23:23:34.899054Z","title":"Ferret, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:34.899054Z"},"links":{"cited_paper":"/paper/2312.01072","citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:e0ba00cf7b3312812e3d78ee2fb78b17fa0dd255360da18cfa608f5d1588d712","observation_id":"5718411b-dbfe-4b54-a177-6b9c5b198636","resolution":{"observed_at":"2026-08-03T23:23:34.899054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:35.057615Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:35.057615Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:4db67681b31b2aec999ea8a5e7832dea3091a9698d0b431005bf1f14ccfcff12","observation_id":"7b627236-2461-4c79-a5d7-b27b5089613a","resolution":{"observed_at":"2026-08-03T23:23:35.057615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.05866","last_updated":"2017-09-28T21:51:43Z","snapshot_observed_at":"2026-07-06T05:55:53.655263Z","submitted_at":"2017-08-19T15:55:31Z","title":"A Brief Survey of Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.05866","snapshot_observed_at":"2026-08-03T23:23:35.220835Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:35.220835Z"},"links":{"cited_paper":"/paper/1708.05866","citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:170983482a85539f9f5e1dc9b78b44a062cdcb25f3c207b235177cf62bd852d2","observation_id":"8789beff-5f02-4c6f-ae53-c11b946c3a5f","resolution":{"observed_at":"2026-08-03T23:23:35.220835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-03T23:23:35.405091Z","title":"Wolski, P","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:35.405091Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:10c9459498e98eaaebf33cc2b7750554600ec3b0ddc436caf731b9f6a037d1af","observation_id":"1049e798-0652-47aa-92d2-21e7a3d1d942","resolution":{"observed_at":"2026-08-03T23:23:35.405091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-08-08T15:29:26.223468Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-03T23:23:35.541666Z","title":"Moritz, S","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:35.541666Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:c6281d731f7fe768f56fc8deae779ecf9b697a9fa41615b75ec6e65ea9a5f3ef","observation_id":"12ef41fb-f7b9-4593-8bc1-2bc593182898","resolution":{"observed_at":"2026-08-03T23:23:35.541666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:35.666933Z","title":null,"venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:35.666933Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:824408b67ec937e360fbb1f3bb694b818287795c6976920a42b2ee6267e4fae9","observation_id":"1fa94b80-8582-426b-88d9-1a821197fcea","resolution":{"observed_at":"2026-08-03T23:23:35.666933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:35.794591Z","title":null,"venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:35.794591Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:357a31dbc29c70a7a3ae450e11ad4c9c12820724c6c59329308181d0eea4a873","observation_id":"ca59cad7-284c-4b44-877d-08103acce6a6","resolution":{"observed_at":"2026-08-03T23:23:35.794591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:35.928226Z","title":null,"venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:35.928226Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:f4ded41283971ccf76b9d9efb9fc3f8e0afa5916bc75dbf6204bc9180b4a2e45","observation_id":"7b413353-06bf-418e-80b8-9aca7a7ecfa9","resolution":{"observed_at":"2026-08-03T23:23:35.928226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:36.117077Z","title":"Inaudi, and G","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:36.117077Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:109d24d85db591bbb4b3e2fe483f7659e8bc398497c6454ef6cd216466f93bdb","observation_id":"6a958d6b-f35c-427a-ac66-5305f62290f5","resolution":{"observed_at":"2026-08-03T23:23:36.117077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:36.282047Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:36.282047Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:23f82fe6307e4bfa0691711fd31d04528a94d23486a46c9530eab452fa719c69","observation_id":"8e1e8422-0889-4a9b-9299-aa168721621a","resolution":{"observed_at":"2026-08-03T23:23:36.282047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:36.451862Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:36.451862Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:5ca6f1419e1961aaa6853f12066affa75823f2d61d52b2e09f75f9a507a8bf4f","observation_id":"68a46a14-794c-442f-9fb0-91fec737971c","resolution":{"observed_at":"2026-08-03T23:23:36.451862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:36.589956Z","title":"F., and J","venue":null,"work_id":null,"year":1990},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:36.589956Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:03b4af179734e5695de7e6192c2a0fde7ab4465adaae42de2141a598f4dfd256","observation_id":"86d265f0-ed73-49f5-aff0-9f84de8db72e","resolution":{"observed_at":"2026-08-03T23:23:36.589956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:36.711536Z","title":"Gu, and M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:36.711536Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:3b7fff1e571120c41064b3c9536d266ad09e0f2702c636e787ea7213dcd5ccf0","observation_id":"0317c9b9-e440-4174-8c4e-f1ae8fb5ee58","resolution":{"observed_at":"2026-08-03T23:23:36.711536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:36.865095Z","title":null,"venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:36.865095Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:9a3605e6521761a8ef13f38bb8feeff50d3a3ae9139322ac2b85a033945ecdc2","observation_id":"1e1017ee-65d9-4539-bca2-99304ad67cac","resolution":{"observed_at":"2026-08-03T23:23:36.865095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:37.037920Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:37.037920Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:20d7f916f5aab6ad349023904be5c1eeb4c70796bc04b96de0d27ee7f2bec46f","observation_id":"46b76a8b-96d2-46d2-b48b-c39b83c678ef","resolution":{"observed_at":"2026-08-03T23:23:37.037920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:37.143895Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:37.143895Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:fdab3f4f92827b63fc4a7a6d71f8a70fd5759858d3c6550c706da8e157b679fb","observation_id":"587cb204-7748-472e-8200-198113e4dc4d","resolution":{"observed_at":"2026-08-03T23:23:37.143895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:37.279728Z","title":"Van Lint, T","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:37.279728Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:c7cb0b2aab00c01c7da8ba971c1e760095c6c60309768ebcf8859f080ee9618c","observation_id":"43e9d9b3-e035-40a3-b35a-604b93d6c33a","resolution":{"observed_at":"2026-08-03T23:23:37.279728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:37.427176Z","title":"Khoshkhah, and A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:37.427176Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:7cbc2ef051205ad88ffe6d0e355d94bad4160f51875e7f6424f8aedd4e7fe0ed","observation_id":"a559974e-e483-4f8a-838c-6a247a58d46e","resolution":{"observed_at":"2026-08-03T23:23:37.427176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:37.549100Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:37.549100Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:e57db384e636937cd59c86811a9e5af957339eecd98ac8bda2d1a6f230cfb987","observation_id":"c2fb4ad4-7816-4cf4-889b-f5edcbf8bbcc","resolution":{"observed_at":"2026-08-03T23:23:37.549100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:37.675216Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:37.675216Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:b152460112a1c00fb78cc4c446aaea052670d6e5d9b02088192abc4c1c1dc8f0","observation_id":"880b8f0e-dcf1-4ecb-b347-458262dd4e5e","resolution":{"observed_at":"2026-08-03T23:23:37.675216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:37.795580Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:37.795580Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:9ebd113546768fde913e24be138c442d36110191967eae7e57af024c823ab7e2","observation_id":"50f11dea-88df-46c7-ac0b-33cbfb6a2074","resolution":{"observed_at":"2026-08-03T23:23:37.795580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:37.967122Z","title":"Value-function Approximations for Partially Ob- servable Markov Decision Processes.Journal of artificial intelligence research, 2000","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:37.967122Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:f82734138e3d0a66daa3046bee865eb132f8eee17fbf09a9b0d8fb196db0ddf4","observation_id":"dd34e80f-48f7-4560-86f1-60587a2fe5a0","resolution":{"observed_at":"2026-08-03T23:23:37.967122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:38.086574Z","title":"Liang, and N","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:38.086574Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:3900ad3234b49a41a5c0cefc33720a2aa657d9a5a2da7df81da97cb0958faa32","observation_id":"4797e490-440e-4379-b6a8-0fe66b5ef3cc","resolution":{"observed_at":"2026-08-03T23:23:38.086574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:38.271542Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:38.271542Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:db9935206ba0745d01edb22d8fc867982694d124e6cb04e97167a331aae6a216","observation_id":"80366d07-d79d-4e8d-939a-76be2ab7a8d2","resolution":{"observed_at":"2026-08-03T23:23:38.271542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-03T23:23:38.403820Z","title":"Kavukcuoglu, D","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:38.403820Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:ed90132942f50772d190bf1a0c62063a8845a79350887f422c2caf37fb49ca63","observation_id":"40811562-c89f-4b5b-b95b-9d9d01ee8089","resolution":{"observed_at":"2026-08-03T23:23:38.403820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:38.580516Z","title":null,"venue":null,"work_id":null,"year":1984},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:38.580516Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:90c0646ba8beb7141a858f2d221d75e5e685b6b0e627c5f8979bcbcaed7cd88f","observation_id":"5f782bc9-7730-4c92-9a0a-c28f9349ef86","resolution":{"observed_at":"2026-08-03T23:23:38.580516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T23:23:38.772041Z","title":"Springer, New York, 2010","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:38.772041Z"},"links":{"citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:430e1feb8d39c1170d1bbe79114cf60a265dd2ab4ab2485f6416c40fbcfc663b","observation_id":"6a747b68-069f-4769-a3ff-4a131919dcbd","resolution":{"observed_at":"2026-08-03T23:23:38.772041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.02811","last_updated":"2018-07-08T13:06:26Z","snapshot_observed_at":"2026-08-07T12:49:05.688504Z","submitted_at":"2018-07-08T13:06:26Z","title":"A Tutorial on Bayesian Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.02811","snapshot_observed_at":"2026-08-03T23:23:38.957539Z","title":"I.A Tutorial on Bayesian Optimization","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T23:23:38.957539Z"},"links":{"cited_paper":"/paper/1807.02811","citing_paper":"/paper/2511.06229"},"observation_digest":"sha256:b755f6d63c406010b080225b0f889c3938631d75a708eebbb6118a8ea8aaf2b0","observation_id":"38c75a37-918a-434b-a8a4-071d03487b52","resolution":{"observed_at":"2026-08-03T23:23:38.957539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2511.06229","last_updated":"2026-07-07T17:38:23Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T03:52:44.085417Z","submitted_at":"2025-11-09T05:07:42Z","title":"Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2511.06229."}