{"as_of":"2026-08-09T12:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cde8f08fa52812dac29db715b3baff957df5c32199c5b3c02009e9afa1ecfd17","coverage":[{"denominator":60,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":60,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T15:33:56.723175Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.08444/citation-record","integrity":"/paper/2607.08444/integrity","json":"/paper/2607.08444/citation-record.json","paper":"/paper/2607.08444"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":1966},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:96d845cca4a7e976bfe32d17949967d990d8a83f0f1fdfe232d1c15267101e1a","observation_id":"76524b59-cfcf-4fab-a874-d2880812fef1","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:a108590d75d91d7183cf39fdec9ef0d2013f060879699ac5e210c1014781236b","observation_id":"a607e88e-e083-4d9b-afef-543489352df1","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:a95bb2ee151e739aa4ec246fecc5f67f66e60609010b24e6bca48f65353f2e5d","observation_id":"6cc71e4c-9eaf-4d64-b1c3-620e5412f2a1","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:55aa7199ee25854e6cf61e470862130961df6fd846209e74ae9a53946dbc2ebb","observation_id":"631648e2-2480-46c2-8b49-b25b12b3c5bb","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.02787","last_updated":"2020-06-04T12:56:16Z","snapshot_observed_at":"2026-08-02T00:46:52.816691Z","submitted_at":"2019-10-01T22:12:00Z","title":"Quantile QT-Opt for Risk-Aware Vision-Based Robotic Grasping","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.02787","snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Bodnar, A","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"cited_paper":"/paper/1910.02787","citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:30f849d09d302d97bf39aea2d4a38a82f49cf411156cad842a8b2f2a28460004","observation_id":"b694c1d6-239b-414b-8c84-a36271a795f1","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Boucheron, G","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:878ca861dd671a499fbf193eceef4fd43e7364f4c43f033079c890d71fc78d42","observation_id":"75e9e988-d3b6-4432-9461-78bbfcaf8e52","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Brézis.Functional analysis, Sobolev spaces and partial differential equations","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:e5723d085fa6c1cb4e18ff40ac111cb80ce96a84cad5612361cbb2f71427b8af","observation_id":"34868f22-b2a7-44b6-85e4-45d327cf580c","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Chandak, S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:6d7e71cc12bb0d1389728caec1dbe1d9f817d702ca8a612dcae86bb16acbb78a","observation_id":"2a257b1f-fe49-4f05-aab7-def7c952f8c9","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:b9b8ed931a2e296665cea51a882d0b27ad55dd0b2c92dcd666ba3dce1fcf41c2","observation_id":"f6b9511a-7d69-4f62-bf55-aeaaf8201232","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:39539333b78158a4a125a93b7e370f9292d295349c5dff220ce05c97f28988cb","observation_id":"4755a2c5-0053-43ea-ac88-89698ad08070","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Dabney, G","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:f6d19f526ac7c073f0a02706c19db5946dfb6cb29c12cc64a0b8def2e0312ec1","observation_id":"f5e703d8-ceb6-4537-86d8-a39ac777882b","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Dabney, M","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:c92e7b79b6872a2a533b94410ebba2bd634e95b987bb74915bfc1bc34e26d9a9","observation_id":"2d9c1b0f-40a2-40f1-83de-71607cb9cad9","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.04874","last_updated":"2018-07-20T22:22:53Z","snapshot_observed_at":"2026-08-05T18:50:53.077373Z","submitted_at":"2018-05-13T12:41:53Z","title":"GAN Q-learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.04874","snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"cited_paper":"/paper/1805.04874","citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:6dfab43a59f326bc2624dc79824fc2dbd345ca7513366d609852be78a391d0bf","observation_id":"43ccb0c8-0206-4d5a-9703-b20089470428","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Fawzi, M","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:4b3bfc223ce3edbc7d94499b0f88ff6b23c011b75ec475d19cddcb96a598541f","observation_id":"e1337398-3509-463c-b3de-a1c30437744f","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Freirich, T","venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:ee4d9b16c9be88e9d35b78449cd50c5d454e38f6418104b9aa6558d7cc353f3e","observation_id":"2ac0d05e-32d9-4cb6-a79e-069bd9efaef0","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Ghysels, P","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:3d7d0f6cdd13bf0d0a301f5a8037c87319e73296953fd7dda57f0ccc919af56e","observation_id":"c2a10a1a-e06d-42dd-9ac0-f658bec8770b","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:33e374cc9a8847c1bfec11e7f1c322ecba0cf096b70634a8470354b3d4efc4b6","observation_id":"4eddc62f-f3c5-43a6-8006-da5c548c230e","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:2b0fb0b14240c4dea47ad3392e0cf1bbb912d7f11e188cb96d87290dfab3a20f","observation_id":"f8cc8418-990a-44cb-b66c-910603f9a5ae","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Huang, L","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:ed48522a5740fb00ffc4eb0899b8e411c6c0551497606d6b52939fcadbaffbc7","observation_id":"10742c82-c65f-49f6-9e6e-852a7aa74ca2","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Jiang and L","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:d292d79d2edea2b3041449138e85c6592377197210ae020a9badaf57950cb485","observation_id":"fb53c6c9-5579-493c-a006-512ffbd8e87b","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":1967},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:1b1571cf5779bb7910a8e03e74aa2edb98bc8b6fad2e2b5d4599dec0ed915278","observation_id":"ac40d1c1-f355-4472-85f0-464593c709b5","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Kober, J","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:b5354175cf5ca7a080847e5e25a2d9ab9c6ade2b4adc9e3434812b8883b40c9a","observation_id":"b777d0ad-05cb-4980-b8ab-81b474bc0501","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:9f24ef7dcac9ecc1aed1048ca0dbace054bce19c5bc03358a54ed40d97db8620","observation_id":"2df67b69-7115-4cfa-bf88-89583765f37a","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:e103cfdeb378c26b78699f1e0de4ff558f0aab9013a1ea6ccbd6154bf1ba3565","observation_id":"955a737b-d0d2-46b8-81ca-cfcec5c5eee6","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:4cb5682a4e6c89d83478d1a9d3ce14d0b4780cdd963ad143880d3d05facfc727","observation_id":"98bac30f-eca9-476d-a49c-270acc54c656","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07690","last_updated":"2023-02-20T00:45:45Z","snapshot_observed_at":"2026-08-09T00:00:59.551810Z","submitted_at":"2023-02-15T14:31:11Z","title":"Online Statistical Inference for Nonlinear Stochastic Approximation with Markovian Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.07690","snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"cited_paper":"/paper/2302.07690","citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:56832440de2afc792f149cd7b0de133b69bb2f5baab6a3fa28c3485da95103f1","observation_id":"c5a04b5d-2ec8-4ac2-9809-f284e746d889","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:f415192480431f7e4db4b635b5ca7f92eac604c27625380757d80456a27dd814","observation_id":"b444ccd3-8ccf-40f7-9bd7-028cc3637477","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":1990},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:f24039ac3d9f066e18456502c516f5a579f498b92d5f711c660f11922cf4b851","observation_id":"dd0a4af8-91f9-4dd7-846f-7402e8c7f14c","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Morimura, M","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:fa63846694f644304ac1f6c62762b55422f3a10984d70a623f5a9bcbbde7fe2f","observation_id":"4360240c-5b1d-4be0-aa13-98ca2e5f3a47","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Naeem, S","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:993b757323d7e6b78375aac3ce42feb0fbcc74298121e8214d372520782a0e83","observation_id":"82290754-ff89-4760-8cb1-e8f1d128be32","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Gpt-4 technical report, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:7bf94b611798a1572d19f37b2996e3f9bf5202f6706b289c73420933b9f8dc3c","observation_id":"640b97f7-986e-4c64-ba57-6021db2e9fb4","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Ouyang, J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:585a332db54b00d0d9d9348baa34d1691f035b61dead46ba292bac80a31091af","observation_id":"3d395b23-568d-4d85-8e37-e6238e75f901","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:8f2bc062450c8f09ad2fa10668bd0ff922e325f0dfddaa4bf09d1c5230c57355","observation_id":"21e0dea1-41c8-40d0-bb13-3cf66beb3aa3","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14172","last_updated":"2025-05-13T08:03:07Z","snapshot_observed_at":"2026-08-07T18:03:20.118566Z","submitted_at":"2025-02-20T00:53:22Z","title":"A Finite Sample Analysis of Distributional TD Learning with Linear Function Approximation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14172","snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"cited_paper":"/paper/2502.14172","citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:d6c0d5c8c21353194dde63401f01b0cb5d486aa0c520222faf80dfda2884f0c6","observation_id":"bb4895f7-e9e9-48c5-bbb0-d6e3836da0e6","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:fed624f986c187c25aa1c1d1078fd8cbf3d375e62913d5f0f4fdc6c83c790eba","observation_id":"c4c992e3-507a-40f8-abb8-742dbb487b95","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:34a9bb3b8897b7e6c291b8cd528f80bf9f2bb215292b21362af4ad43f4fc1baf","observation_id":"2bf9d35d-957f-43f5-9d38-df3deffa5516","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Rowland, M","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:a3d1e328849c2344a198562b5f9b2dfa7c5790e7d84bda7c40612aa802a41784","observation_id":"010f4e54-0123-4e25-ac94-e6a2b604ad72","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04462","last_updated":"2024-05-20T10:03:58Z","snapshot_observed_at":"2026-08-05T02:21:38.292947Z","submitted_at":"2023-01-11T13:41:56Z","title":"An Analysis of Quantile Temporal-Difference Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04462","snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Rowland, R","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"cited_paper":"/paper/2301.04462","citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:c1a04601ce0a1a2246ccf0e010c1bc012b3717e8d24d502ca1700fa267d65b0b","observation_id":"14f13da4-54d0-413a-a920-daff9504d98e","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Rowland, Y","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:39e29ed5fb45a7680342b51d48b81f18848d1062fa20af73c4fba2b647b815d6","observation_id":"a449ee5e-fc53-4eaf-9053-1e3cb114d509","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:afae54cc5e3697eab3b06307f10c5732de6a7e0093fa84480aa9bfd5a28fc945","observation_id":"45db386c-63a0-46f0-84d5-0e8d7c54d79b","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Shao and Z.-S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:289bfa08d5cdce27a5c0fa37174b54b1751fd213a29754fd406057583d996604","observation_id":"843c7602-ecfb-4653-923b-b1aac12a435c","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Shao and W.-X","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:4ecaacd33d7158a73627f989143116f2daf70a067b68e2341e004c5e327f30aa","observation_id":"0b9930da-ca39-4bda-ab51-0794152240a0","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:5327a38647df058b9f8cf697e7a1f5793cf3f03a96f558556d1a07af34aa07bc","observation_id":"173e2a23-6dc3-4acb-88f7-f4e278701bc9","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Silver, T","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:31dcf9d7ef8e908ab9469e89fdea9e942b1df2034a172765d4144ce63620810c","observation_id":"6a209939-e5e3-41cd-9b60-67cf1bf079c9","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":1956},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:3cf47d7a182d999afb095cfc25cc1b53fd3af407874a353b82185f99141b931d","observation_id":"3ab3cb22-1eff-4d91-a623-9cd2c5217bf9","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:4708699d203a84a3ce456c999028f40744e0b818d174b4d6e75508b63a5c57b7","observation_id":"fe4a3b5b-4a0f-4dc7-a2e3-37b29fb15790","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:ab89e6bd56dfbe5ab3f89a52284a12cb06e93e23a6d01f7e2d9328623960e96d","observation_id":"9c490c51-ba3b-4947-9759-931aecb4265f","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":1957},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:d589c48bebeeac78adbf302baa22869ee4699d58c59f828dcc0ee30bc0ec1580","observation_id":"6767b9f9-a247-4498-aed0-7ab41290040f","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Thomas, G","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:06602f0782f7e52490cdb273c0db5427b6804583aea5dcf93d864fba4955284a","observation_id":"443e720c-205a-48a2-aa75-3526c95dd4e4","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"van der Vaart.Asymptotic statistics, volume 3","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:5760582a0ac71b7943e1c938899297fb6955c14fe36a5c88447ffb4e8fa231c5","observation_id":"956088ac-0119-4d8a-9a7c-448a867c71df","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"van der Vaart and J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:ad50989c4183a8d47f08a54a38a06ec1885c6a77aea01acfec2638ae987c5e2b","observation_id":"dab6cf42-4045-4dc2-8258-0ccdf538d42c","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Vershynin.High-Dimensional Probability: An Introduction with Applications in Data Science","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:220c60a2ed7ced08cafbe53b610a6c0082b343e4c96ac44b6681844d763a57fa","observation_id":"0710b76c-a26c-47c5-9e64-cf59a8e22c98","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:0d026d46fd82bf3faf433e281464d50acf3cb8ecd04de3c3b67c6410b1413c27","observation_id":"2619a55d-bc6e-4a87-83e3-adb406691c60","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Vinyals, I","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:f41e3d868bc5b5fec0adbefcd9e542354da36e1c64bf1df70939df0ad0dbf5ad","observation_id":"d8d7d10b-190e-43aa-acf3-876b78ee0b6a","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.09456","last_updated":"2023-12-29T09:56:07Z","snapshot_observed_at":"2026-07-06T14:53:20.639529Z","submitted_at":"2023-02-19T02:11:22Z","title":"Distributional Offline Policy Evaluation with Predictive Error Guarantees","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.09456","snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"cited_paper":"/paper/2302.09456","citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:f7dbc765323fca56b87e9ab5503b7fff3224fdd77e6cf247b58e983d4a106d0e","observation_id":"a8e99db3-e89d-4a2f-88ec-d571e0f00e5d","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:8bc56b5ec385e86bcb9a9cef91c97f8f626730fe7e3eae225c93e0f85d70a34f","observation_id":"08c88ad0-7a75-49b3-8a9f-1b48282810ad","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:2e38c9cfaabded805bae2f49c0003fde8564a01d48cb69a589d816cba22b04a1","observation_id":"dff00533-d083-455b-a4a1-7a19a58588d6","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"Zhang, Y","venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:9f8bc6d44324d4729c7432bc54759360a69da3b2c75524d270c80e513b0c7907","observation_id":"36d6e246-7d6c-45bb-b04f-0449922ae853","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:c1fac673d8c066eafcb3ad5499b1351e8b0d9e2f82f81b52a5f174595fdd2729","observation_id":"273601ec-2602-429f-b4af-c4381ccf36de","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:33:56.723175Z","title":"1 m mÿ j“1 p pF pnq s,a ´F s,aqpθmps, iq `u´γθ mps1, jqq and forλPR, we have EexppλZ pnq s,i q ď ÿ aPA πpa|sqEexp ˜ λ ÿ s1PS ws,i,a,s1","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-14T15:33:56.723175Z"},"links":{"citing_paper":"/paper/2607.08444"},"observation_digest":"sha256:72d6d13ebb919632d9802fd0b02c25093613272faea7d3098d078747df12ba34","observation_id":"2516c973-894c-4cc8-b644-4f61f8b08047","resolution":{"observed_at":"2026-07-14T15:33:56.723175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.08444","last_updated":"2026-07-12T02:13:57Z","latest_version":2,"primary_category":"stat.ML","snapshot_observed_at":"2026-07-16T23:18:48.375139Z","submitted_at":"2026-07-09T13:06:07Z","title":"Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning"},"reference_resolution":{"displayed":60,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":60,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":60},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 0 inbound Pith citation observations for arXiv:2607.08444."}