{"as_of":"2026-08-10T04:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:80b26089d5d234d2a4e766f918b53954ae60c954c4fee9bf4ca63a822285b1e3","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T16:09:10.359051Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2512.14991/citation-record","integrity":"/paper/2512.14991/integrity","json":"/paper/2512.14991/citation-record.json","paper":"/paper/2512.14991"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:09:10.229563Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.14991","last_updated":"2026-07-06T16:45:59Z","snapshot_observed_at":"2026-08-09T01:29:28.771698Z","submitted_at":"2025-12-17T00:52:19Z","title":"Adaptive Partitioning and Learning for Stochastic Control of Diffusion Processes","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T16:09:10.229563Z"},"links":{"citing_paper":"/paper/2512.14991"},"observation_digest":"sha256:f0e81c246411088e5c13589dc7d132d681f8349366eaba11d2302b2e0cd92284","observation_id":"550ef6e3-66f2-41d3-8e80-97fc9fd96268","resolution":{"observed_at":"2026-08-03T16:09:10.229563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:09:10.359051Z","title":"The first inequality holds due to Theorem 5.2","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2512.14991","last_updated":"2026-07-06T16:45:59Z","snapshot_observed_at":"2026-08-09T01:29:28.771698Z","submitted_at":"2025-12-17T00:52:19Z","title":"Adaptive Partitioning and Learning for Stochastic Control of Diffusion Processes","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T16:09:10.359051Z"},"links":{"citing_paper":"/paper/2512.14991"},"observation_digest":"sha256:f10981396bbc37aa73da9936e2b2458c4f0cfb240991441b5863d07731a12212","observation_id":"534c7604-3787-4661-aea2-18cb0f18ed9f","resolution":{"observed_at":"2026-08-03T16:09:10.359051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:09:08.553489Z","title":"Xin Guo, Xinyu Li, and Renyuan Xu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.14991","last_updated":"2026-07-06T16:45:59Z","snapshot_observed_at":"2026-08-09T01:29:28.771698Z","submitted_at":"2025-12-17T00:52:19Z","title":"Adaptive Partitioning and Learning for Stochastic Control of Diffusion Processes","version":2},"reference_index":1984,"source":"pdf_text","source_observed_at":"2026-08-03T16:09:08.553489Z"},"links":{"citing_paper":"/paper/2512.14991"},"observation_digest":"sha256:2bb15c07c0d2e3b39961d36f15eb072814eacdc899b01a6f185e94d21b7ddd09","observation_id":"e4a40d9d-17a0-493b-930d-34b9ec8002ab","resolution":{"observed_at":"2026-08-03T16:09:08.553489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.03295","last_updated":"2016-10-11T12:09:03Z","snapshot_observed_at":"2026-08-03T05:49:14.071341Z","submitted_at":"2016-10-11T12:09:03Z","title":"Safe, Multi-Agent, Reinforcement Learning for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.03295","snapshot_observed_at":"2026-08-03T16:09:09.080273Z","title":"doi: https://doi.org/10","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.14991","last_updated":"2026-07-06T16:45:59Z","snapshot_observed_at":"2026-08-09T01:29:28.771698Z","submitted_at":"2025-12-17T00:52:19Z","title":"Adaptive Partitioning and Learning for Stochastic Control of Diffusion Processes","version":2},"reference_index":1992,"source":"pdf_text","source_observed_at":"2026-08-03T16:09:09.080273Z"},"links":{"cited_paper":"/paper/1610.03295","citing_paper":"/paper/2512.14991"},"observation_digest":"sha256:b07bd98c66730b52fe48d71290e717cdfdcf75cf045ba24d74005a36cc707559","observation_id":"05a5fea8-b366-435d-8913-06dd337ab50c","resolution":{"observed_at":"2026-08-03T16:09:09.080273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.06971","last_updated":"2018-03-19T15:02:15Z","snapshot_observed_at":"2026-07-06T06:29:04.031745Z","submitted_at":"2018-03-19T15:02:15Z","title":"What Doubling Tricks Can and Can't Do for Multi-Armed Bandits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.06971","snapshot_observed_at":"2026-08-03T16:09:08.285940Z","title":"Whatdoublingtrickscanandcan’tdoformulti-armedbandits","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.14991","last_updated":"2026-07-06T16:45:59Z","snapshot_observed_at":"2026-08-09T01:29:28.771698Z","submitted_at":"2025-12-17T00:52:19Z","title":"Adaptive Partitioning and Learning for Stochastic Control of Diffusion Processes","version":2},"reference_index":1996,"source":"pdf_text","source_observed_at":"2026-08-03T16:09:08.285940Z"},"links":{"cited_paper":"/paper/1803.06971","citing_paper":"/paper/2512.14991"},"observation_digest":"sha256:f73587977176a1a1ee5ea6a8fcb3ded2656c89510397e22ecec6e26c9238eb3b","observation_id":"c5628351-9855-4e58-af44-9905726c7cf9","resolution":{"observed_at":"2026-08-03T16:09:08.285940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:09:09.937985Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2512.14991","last_updated":"2026-07-06T16:45:59Z","snapshot_observed_at":"2026-08-09T01:29:28.771698Z","submitted_at":"2025-12-17T00:52:19Z","title":"Adaptive Partitioning and Learning for Stochastic Control of Diffusion Processes","version":2},"reference_index":2000,"source":"pdf_text","source_observed_at":"2026-08-03T16:09:09.937985Z"},"links":{"citing_paper":"/paper/2512.14991"},"observation_digest":"sha256:c36b7f503716d7727ee987ab927e032fc23d14cb6ca9d28caa6a91e73c662fe0","observation_id":"0abd8816-f6e1-402e-a0a7-aa0ac33c60c1","resolution":{"observed_at":"2026-08-03T16:09:09.937985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:09:08.830896Z","title":"Reinforcement learning with selective perception and hidden state","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2512.14991","last_updated":"2026-07-06T16:45:59Z","snapshot_observed_at":"2026-08-09T01:29:28.771698Z","submitted_at":"2025-12-17T00:52:19Z","title":"Adaptive Partitioning and Learning for Stochastic Control of Diffusion Processes","version":2},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-03T16:09:08.830896Z"},"links":{"citing_paper":"/paper/2512.14991"},"observation_digest":"sha256:5a1bf3435d9299d48a68e62de23301b644eae7f35fb0ea3071140734cca490a9","observation_id":"dd807430-6d12-487e-9300-939367494a3d","resolution":{"observed_at":"2026-08-03T16:09:08.830896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1110.2842","last_updated":"2011-10-13T04:56:17Z","snapshot_observed_at":"2026-08-06T11:35:30.300774Z","submitted_at":"2011-10-13T04:56:17Z","title":"A tail inequality for quadratic forms of subgaussian random vectors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1110.2842","snapshot_observed_at":"2026-08-03T16:09:08.666097Z","title":"Hsu, Sham M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.14991","last_updated":"2026-07-06T16:45:59Z","snapshot_observed_at":"2026-08-09T01:29:28.771698Z","submitted_at":"2025-12-17T00:52:19Z","title":"Adaptive Partitioning and Learning for Stochastic Control of Diffusion Processes","version":2},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-03T16:09:08.666097Z"},"links":{"cited_paper":"/paper/1110.2842","citing_paper":"/paper/2512.14991"},"observation_digest":"sha256:3281dc419a487ad0c674ee8a522da0bfb326cdb1890ac2fb943a510992ac7cf0","observation_id":"1d07bf22-97f5-44f2-9a72-f7e9432d3f00","resolution":{"observed_at":"2026-08-03T16:09:08.666097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00483","last_updated":"2021-06-13T05:25:16Z","snapshot_observed_at":"2026-08-02T22:11:25.670786Z","submitted_at":"2020-08-02T14:01:49Z","title":"Single-Timescale Actor-Critic Provably Finds Globally Optimal Policy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.00483","snapshot_observed_at":"2026-08-03T16:09:08.413214Z","title":"Single-timescale actor-critic provably finds globally optimal policy.arXiv preprint arXiv:2008.00483,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2512.14991","last_updated":"2026-07-06T16:45:59Z","snapshot_observed_at":"2026-08-09T01:29:28.771698Z","submitted_at":"2025-12-17T00:52:19Z","title":"Adaptive Partitioning and Learning for Stochastic Control of Diffusion Processes","version":2},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-03T16:09:08.413214Z"},"links":{"cited_paper":"/paper/2008.00483","citing_paper":"/paper/2512.14991"},"observation_digest":"sha256:c0cf5e4b0131465a148e287acfe4ff04dc2580dda49c5510582499fa98f377ee","observation_id":"8b5b5e0e-0ce1-47d5-9d2a-b3b1ae2a03e9","resolution":{"observed_at":"2026-08-03T16:09:08.413214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1209.4340","last_updated":"2014-07-15T14:41:58Z","snapshot_observed_at":"2026-07-06T02:55:56.040964Z","submitted_at":"2012-09-19T19:31:58Z","title":"Moments and Absolute Moments of the Normal Distribution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1209.4340","snapshot_observed_at":"2026-08-03T16:09:09.608604Z","title":"Moments and absolute moments of the normal distribution.arXiv preprint arXiv:1209.4340,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.14991","last_updated":"2026-07-06T16:45:59Z","snapshot_observed_at":"2026-08-09T01:29:28.771698Z","submitted_at":"2025-12-17T00:52:19Z","title":"Adaptive Partitioning and Learning for Stochastic Control of Diffusion Processes","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-03T16:09:09.608604Z"},"links":{"cited_paper":"/paper/1209.4340","citing_paper":"/paper/2512.14991"},"observation_digest":"sha256:92bc4c395216e7dbd53dd015ea67d773d2013148c5fa8391524f1cd91f1ebb0a","observation_id":"7ea843c3-46f7-49b1-8847-bb0854c5f9f8","resolution":{"observed_at":"2026-08-03T16:09:09.608604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.01150","last_updated":"2019-11-12T21:42:43Z","snapshot_observed_at":"2026-08-04T13:08:13.681112Z","submitted_at":"2019-08-29T15:38:19Z","title":"Neural Policy Gradient Methods: Global Optimality and Rates of Convergence","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.01150","snapshot_observed_at":"2026-08-03T16:09:09.416245Z","title":"Neural policy gradient methods: Global optimality and rates of convergence.arXiv preprint arXiv:1909.01150,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2512.14991","last_updated":"2026-07-06T16:45:59Z","snapshot_observed_at":"2026-08-09T01:29:28.771698Z","submitted_at":"2025-12-17T00:52:19Z","title":"Adaptive Partitioning and Learning for Stochastic Control of Diffusion Processes","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-03T16:09:09.416245Z"},"links":{"cited_paper":"/paper/1909.01150","citing_paper":"/paper/2512.14991"},"observation_digest":"sha256:fdd96d49130fae2433179ebb3533eb8e57f850bb92f5194fd72ce05d915ee4da","observation_id":"19e16767-28a5-46df-b75f-58bd86f541c0","resolution":{"observed_at":"2026-08-03T16:09:09.416245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07591","last_updated":"2026-05-30T18:39:29Z","snapshot_observed_at":"2026-08-07T03:38:19.454726Z","submitted_at":"2023-08-15T06:24:53Z","title":"Approximations and Learning for Continuous State and Action MDPs under Average Cost Criteria","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07591","snapshot_observed_at":"2026-08-03T16:09:08.751464Z","title":"Q-learning for continuous state and action mdps under average cost criteria","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.14991","last_updated":"2026-07-06T16:45:59Z","snapshot_observed_at":"2026-08-09T01:29:28.771698Z","submitted_at":"2025-12-17T00:52:19Z","title":"Adaptive Partitioning and Learning for Stochastic Control of Diffusion Processes","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T16:09:08.751464Z"},"links":{"cited_paper":"/paper/2308.07591","citing_paper":"/paper/2512.14991"},"observation_digest":"sha256:9a6e430df4560b718d5fd79fe65cc585a84a335f7f18d43ff0aa32d5589117ed","observation_id":"eb9d6e03-b586-4be4-9ee0-797fa38f872f","resolution":{"observed_at":"2026-08-03T16:09:08.751464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T16:09:09.745306Z","title":"Sim-to-real transfer in deep rein- forcement learning for robotics: a survey","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2512.14991","last_updated":"2026-07-06T16:45:59Z","snapshot_observed_at":"2026-08-09T01:29:28.771698Z","submitted_at":"2025-12-17T00:52:19Z","title":"Adaptive Partitioning and Learning for Stochastic Control of Diffusion Processes","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T16:09:09.745306Z"},"links":{"citing_paper":"/paper/2512.14991"},"observation_digest":"sha256:dd209a2aa76d96f208790e7bc51282a142f2f9df113dfc55f341dd94ea0462b7","observation_id":"d400f9cc-b0e6-41d5-9c7d-320d7f93d2c8","resolution":{"observed_at":"2026-08-03T16:09:09.745306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2512.14991","last_updated":"2026-07-06T16:45:59Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T01:29:28.771698Z","submitted_at":"2025-12-17T00:52:19Z","title":"Adaptive Partitioning and Learning for Stochastic Control of Diffusion Processes"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 0 inbound Pith citation observations for arXiv:2512.14991."}