{"as_of":"2026-08-09T12:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f1c2b766db035da7cfeba15f8a3e88147ed97b8a24424e86e4452f3aaca4bd4d","coverage":[{"denominator":77,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":77,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T10:46:25.335756Z","state":"measured"},{"denominator":77,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":77,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.04218/citation-record","integrity":"/paper/2604.04218/integrity","json":"/paper/2604.04218/citation-record.json","paper":"/paper/2604.04218"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Bergsma, N","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:fc121857af288a04c6017b66248665c608920f68bd52de1760cfe0576975f27a","observation_id":"61e26d47-717e-45ae-b059-4038b933ba81","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Berkes, W","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:db8153b9a513e7373847bf8eaaf688219a59bcf0400f965c492f6f5108ca99b9","observation_id":"35eab83c-1b5f-48aa-aaa8-8df13a256001","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Bhandari, D","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:8141696e33ed4a781a7aad04ea8c606973f9cc6c85084e657258388000342689","observation_id":"878804cb-f17e-45c3-9bad-5fb9a7386696","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1214/24-aos2436","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bonnerjee, S","venue":"The Annals of Statistics","work_id":"2e8fa82b-42d0-4011-88f9-d55dc998d930","year":2024},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:c9222e040f06f23cf782d5044095c234ab56291ebf8fa351a9bb7cf1d1025d26","observation_id":"9cd6e9f8-86d3-4618-8c37-32d12575cce6","resolution":{"observed_at":"2026-07-13T10:49:34.107201Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08125","last_updated":"2026-05-07T02:51:33Z","snapshot_observed_at":"2026-07-06T21:22:55.485833Z","submitted_at":"2025-05-12T23:40:13Z","title":"Sharp Gaussian approximations for Decentralized Federated Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.08125","snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Bonnerjee, S","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"cited_paper":"/paper/2505.08125","citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:4be3d829f6f2334881121c5bf68b63ea8988cfe0ca700185313c5872c8aafdaa","observation_id":"50e2bf94-82e8-4340-a9ee-d07ee535fb2d","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:140607d20becd85a98c2eec826790991a5144a68fee9a0e7f939a4c1d038f916","observation_id":"789bc9da-31ed-4d06-9b21-f3c9cb271d3a","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Bottou, F","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:ca4e5d90ca0a047774db065cddf44c76834304fc1fd9e8afc0c9904789b465ea","observation_id":"cdec813f-9061-4f51-b3dd-6a8a4f1369c4","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:0522cddaed835137d04bce8bbdec1d767afadd67527c31b9b9bf1c68fd61e063","observation_id":"a7346089-00c9-4511-a864-8546b939dd37","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18743","last_updated":"2026-04-05T13:54:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-25T23:41:14Z","title":"From Set Convergence to Pointwise Convergence: Finite-Time Guarantees for Average-Reward Q-Learning with Adaptive Stepsizes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.18743","snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"cited_paper":"/paper/2504.18743","citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:322b1a18439f7b69e07ed1791480a1f482e21b7ddd358adfd91a3a66c5ca4f8c","observation_id":"9d17c2c2-9048-4053-9e45-83e3baa927bc","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:f00c20fb7e0e3b2f06513d5899f0c4874a5c3e5c954e3a700ff18219000482c5","observation_id":"187c1c86-b12b-4d20-93e3-f37ed7649c1f","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.01567","last_updated":"2023-09-04T20:15:15Z","snapshot_observed_at":"2026-07-06T10:37:50.467703Z","submitted_at":"2021-02-02T15:48:19Z","title":"A Lyapunov Theory for Finite-Sample Guarantees of Asynchronous Q-Learning and TD-Learning Variants","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.01567","snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"cited_paper":"/paper/2102.01567","citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:6b55edbdb6a10c76a3006aaa786f8ca98c238896903ced4993645a12c1dd3aff","observation_id":"55c7007f-6f0c-49e4-925b-76cfe072e2b1","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.14444","snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"cited_paper":"/paper/2507.14444","citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:a419e0c8d15a0ed1f948667cbcdde51a545aee51800597c6a7a7340586deec42","observation_id":"b012529b-b82f-4ebe-bc86-7eedd4dd0722","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"o rg o and P. R \\'e v \\'e sz. A new method to prove strassen type laws of invariance principle. 1. Zeitschrift f \\","venue":null,"work_id":null,"year":1975},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:cf8d073ee783d7ab333c23c73044ac6ba059f047c3c148052a49ba1cf1f2010e","observation_id":"1667bf20-fe21-4061-9d1f-b2701e4f9474","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"o rg o and P. R \\'e v \\'e sz. A new method to prove strassen type laws of invariance principle. ii. Zeitschrift f \\","venue":null,"work_id":null,"year":1975},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:4ad0b824412e463956b2d866f23d57b35eb309df7d2e5abc8e491128c6f45b9f","observation_id":"0b2415dd-2ceb-48bf-a054-5acb69e44dab","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Cs \\\"o rgo and P","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:9384d90d852de7b6bf37a799d180c9f8c477c712b4cdc6cacbfff8ce40411c8f","observation_id":"56a4ba80-00f5-485c-b709-8a553b379c26","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Cs \\\"o rg \\\"o and P","venue":null,"work_id":null,"year":1984},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:4cff66600eab46484c4bf6cfac4ef83b5bfc303ccc1c1180bbe24909e35ab4fe","observation_id":"6e56945f-18a4-4678-ae58-cb4ab9d2cbed","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Dedecker, P","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:40098c38db9d3a799c26bfdea55c66a59aba065c68aa450c8b2b382df41e45a5","observation_id":"3a901514-e180-499c-9ce3-833d6cc3bb2c","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07831","last_updated":"2024-10-29T22:57:44Z","snapshot_observed_at":"2026-08-04T12:23:38.852681Z","submitted_at":"2023-10-11T19:16:35Z","title":"Optimal Linear Decay Learning Rate Schedules and Further Refinements","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07831","snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Defazio, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"cited_paper":"/paper/2310.07831","citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:142afa27f46c1b6591779fa40ec6330c5bf5433177bb8794d7dafae56707dbc6","observation_id":"f0041dc8-2c60-4c68-8c1b-e41d9ea4bf8c","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Devlin, M","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:b4d07cfd292313db10dc4120cd953376671f44a48a638e3b0b6467e815be3760","observation_id":"37113e46-8ffe-41b3-ad2f-725b9280ff30","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:a79170890a06236bd8f436403f1bc1168d805bf133b1265ead67787dc6f57526","observation_id":"a2ac3339-d18e-4a53-84a4-545fc9f2f51b","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Erd \\\"o s and M","venue":null,"work_id":null,"year":1946},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:decf4953b2f3c90c427cc43a5a4559c1b7f9bf47a99bbadcc44985c7f0fe0860","observation_id":"22e56ed6-a926-4ce7-af78-38f91f42ab57","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Goldreich, Z","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:1df8d1662cb1d47d125b91a17fa19a11f6b73b02adc0d8951300a93498d460ac","observation_id":"d420fa8f-2578-47c1-a0d4-fbe6814efe52","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"G\\\" o tze and A","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:a961047b0c75cdbe95276152c473b24eb076d0f9b14899e21460d0055c6a0087","observation_id":"db146f43-01ef-4a8b-8da0-f8c4f89fecdc","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"H \\\" a gele, E","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:9d98004a9b9bd951825f37ee4e900b7cc4045cb2e270916b78f6b3e14a863027","observation_id":"9cf7c8a9-3bf8-465e-8d1a-9eb7cc40f58b","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Heyde and D","venue":null,"work_id":null,"year":1973},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:3314335fef32df4fe59e3facfa89a8700cdc98e8951c229b6146dc850d8080ef","observation_id":"fb406268-0373-407b-8e6f-399540a14a87","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Hoffmann, S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:582877e977c59ef2dd281122db8a0ffc3a9c48b0fcd4c8fef2232c86146e4502","observation_id":"b2101dfd-a6b9-4e38-a2c0-db7d911932b5","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Howard and S","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:fdc566d35db4770f75628c39fd957cd6b6e59efde8fad783ef36684efb9a144f","observation_id":"66bef2de-5c8c-48f6-a3e5-f1fa04e80884","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:63b7663c96048092bab20007eb057bb3f3ebe32f4930d30b0ee37c138c4e6793","observation_id":"3bb564b2-0fc2-4f12-afff-dac35ceb111f","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Jaakkola, M","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:d8e99db95971001fedbb545c5ccff90b1924e008099d2e715e3aefde922470d6","observation_id":"a2c504d2-d8de-46d6-af29-8b4c6e678325","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Karmakar and W","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:acbe86fa0536122cd33c4fb02f783f273db5e7d6f3656e1dc048990274b50c3e","observation_id":"a33d123d-3716-4810-a523-c5dd9ca67a5e","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Karmakar, S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:b45915d55c5e9677999b04a4d85a588a9aca8c245652d915a3189d6f74b1c251","observation_id":"bc15df16-3f69-4e0b-af9d-0cef761097e1","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1137/20m1331524","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Khamaru, A","venue":"SIAM Journal on Mathematics of Data Science","work_id":"b57eaa64-897a-417c-ba39-7306d9cbd86b","year":2021},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:fa7ddf9487162f1ce249e759b23b31eb9f5d664c8344d5baa391d9af0ea4d25b","observation_id":"5f958143-e3b6-4321-a8ed-223e9018aaa8","resolution":{"observed_at":"2026-07-13T10:49:34.100216Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Koml \\'o s, P","venue":null,"work_id":null,"year":1975},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:bb2ea5926ce43abac557b20dca1e694499a45febb5c93845469c227cefd60cf9","observation_id":"d05cdda7-b431-4116-aa0f-5e68c8ce4cde","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Koml \\'o s, P","venue":null,"work_id":null,"year":1976},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:07574058a00ca0452f836b585797cf642217ad84f7f1d47726cfea67bd666ea2","observation_id":"55336c1d-3e42-4eb3-9eec-981289cd0a51","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:a2eb0d8afdb3ef55ad290766a8f4a09e992b4c584348ec5ad319a14e29a01a1f","observation_id":"dadd187f-a29c-43d6-8944-a5be571151b8","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:8f9ea27006adf213e68ff15e4467446e19f8fa892a43b8e163176347fcf66719","observation_id":"e3f97386-d900-4a07-8906-915ca0f9c826","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:a61fe5f8680fa20bc6772567b605226c539f057489a84e4214b87a2a4a64a8cc","observation_id":"188b0cfd-3842-4631-98bb-b37e29510f38","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:07f9d23f154dd1e8df8e6066f436012337a7e287fbbb73274503dbec624e9068","observation_id":"07c1f9e2-f6d0-4698-a977-f469372b4825","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07690","last_updated":"2023-02-20T00:45:45Z","snapshot_observed_at":"2026-08-09T00:00:59.551810Z","submitted_at":"2023-02-15T14:31:11Z","title":"Online Statistical Inference for Nonlinear Stochastic Approximation with Markovian Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.07690","snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"cited_paper":"/paper/2302.07690","citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:472c3a71564a911b9dabb31bd49c31aecde3b2320f172e2eb56f5e05d3485a3c","observation_id":"bc509c3a-68ea-458d-a967-fb15d301d611","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:104e69285568163efeddb9fae2c12914276d3f08af329deed4023585d1a9d74a","observation_id":"06af0ac6-1829-4871-8502-4bbe64268d99","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Liu and Z","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:5fe9fd7a778be7b1ac7e885c28ae5310ca1dfee76f5b2274e733693824287057","observation_id":"dae69fbb-c785-4a76-a66e-5be1ec6b4e7b","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Liu and W","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:51fc708d4b5f8b47944d3db9cbdbb5fe437a37ef901625d12447e9545abdeee8","observation_id":"7280d6bd-70ac-45ff-a551-d3fcb649b152","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:0f637d8f377f32fb0c2c7a1de67ccfb1cc8c4f187efea120db823a11e816afb3","observation_id":"189c7860-3247-45b1-a45d-58495e5e2338","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Lu and Q.-M","venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:8433d42dfdeb0f524dabdad7811ad4fd3fc7a712ecaacec7f94655bbd571c381","observation_id":"42579def-f95f-4e98-bfe2-4a10e80e5238","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Merlev \\`e de and E","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:ce8b68d96e1637c25317f418ee4e02584ddd18a71d1062584d7a23b6f9422477","observation_id":"68bedd62-2bef-4f63-8df4-272ea62e1675","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Mies and A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:90b8c5fc64d775a94d06689a6c6b32cf4ea7f61a5a256696bed0c37b7e7f51ba","observation_id":"074001dc-1f09-4257-829e-ea6aefb1f907","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:a1f56b70294ae969f48edbe88e36ba89e931371c0ff5367a16dac34d411a7b00","observation_id":"d541aa90-556a-41a1-b687-f2ef0d3cfcba","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:04b67e91b53e547377711bd8c10f02b3034e4da6f17a863e290e0558f146615b","observation_id":"365f25d5-d05b-46c6-8bc8-bc3787351252","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:4f1fcc5d85e3c2e2df7431aa695887247ae39c47c892b905c4456ff3e4fee38a","observation_id":"0e322a8b-617b-4ece-bff3-1feca76e30fd","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":1979},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:6c724b5aaf549e2e6a5b71c2aaf4e0ce759ea4b527c12614b6efb1f466a8f7b1","observation_id":"a059d481-8362-4d8e-a485-b28a17dfcdb5","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Qu and A","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:6b563aab58a47b81f87aea89e1353e34ad4cb69e456580bf16e8ed3769bb5a81","observation_id":"74927d4b-e407-4b27-a853-d682a4b64085","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:00ff4114dd99694acab713fdc08b63b4df2f736eba415c95c2d2a196bbcb530e","observation_id":"803c7899-7508-47a4-b4ba-8d39c8b0a07f","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Samsonov, E","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:fbcad08512297c5bb7c3d4d62b2aaa081b13c0be7718868924cf0376307574da","observation_id":"b205627d-8459-4d63-b9a0-c6f0a9a216fe","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19102","last_updated":"2025-05-25T11:43:28Z","snapshot_observed_at":"2026-08-09T01:19:17.915221Z","submitted_at":"2025-05-25T11:43:28Z","title":"Statistical inference for Linear Stochastic Approximation with Markovian Noise","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19102","snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Samsonov, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"cited_paper":"/paper/2505.19102","citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:c0a4cdf58b4c49e18bac7862078a6280221b8e4f90975c989b10238cb7023942","observation_id":"54afbaa0-dddf-49ec-ab1f-626face77ea2","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:5b83962e764d290bc9c153a38e7cb2fbd00780198be146e21ac2b33d21c717d9","observation_id":"8f7e18b3-92f9-4d73-93f9-06f3af3f12d7","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:f13a2fc46582d4c7354ddadce9e0f86193bbc9570856195608466624ca3ce315","observation_id":"642c7d9b-db8f-46cc-9ffa-b395f15d4bda","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Strassen","venue":null,"work_id":null,"year":1964},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:7fe1e01539947e8f0481fd445fdef1ed7a903f06bdb5f66590a7b1c58940f4e2","observation_id":"69b3b23c-c747-4eba-803a-605f98b560b6","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:8b000a3027b4aa3ecad793942f21cc77f6ca728f37f0ed8f5636bca1541c157b","observation_id":"c2cabbfd-c625-4b54-a591-394d35f60e40","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Szepesv \\'a ri","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:d1b2d71a49ce939ad5b448fd44768bdfb4876e1d56f28fca607cf6980b23fa27","observation_id":"ca54f142-6c2b-4dfe-aadc-d70079cf7fbe","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Touvron, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:cd65830a7538b9f70731b001b41148a3b6c38684d51826e7c851f8eadc27db39","observation_id":"49cdda4a-2ec7-4013-9cf8-082bb2ac72e2","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:47e02f8241ebe20c5466c9112972365c730768ae76e72ff64ec24215de269172","observation_id":"59b6c84a-5605-4729-9866-6921d0c59e47","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:de88f94b64ef200bfdb9f25e57a51beda18ac6e9f17d3be3467161901e160aa1","observation_id":"500097ea-514c-4687-8550-4b55e2168c89","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:4a9d9725fa63470e2f5dd80ea90329a275b60d7bc34981623d05b4b2a28a6d68","observation_id":"bc8eb826-deb3-48c6-b96d-c8da1bd75eb8","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Waudby-Smith, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:c59dd9a252348ede09e6459395a949edff76c65cf9aaca18d13c94ceca233eef","observation_id":"6cd8004d-647e-4608-b9b5-bed9e4f1507a","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06915","last_updated":"2025-04-06T06:42:12Z","snapshot_observed_at":"2026-08-04T16:07:35.864528Z","submitted_at":"2023-07-13T17:29:01Z","title":"Weighted Averaged Stochastic Gradient Descent: Asymptotic Normality and Optimality","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06915","snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"cited_paper":"/paper/2307.06915","citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:08f187db9b39a336969451fb0c464311bc1f3cf086ba6e03e8b0f37f2ac132cc","observation_id":"03b101fb-9a0e-4b2c-ba04-15fefe580962","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:cd22cc8220e03ac1c9b2c9fd6b281a10388b44da8bf63fcccc738862ed5e3bc3","observation_id":"2f0dfdd0-a1ce-4ae7-9281-11517ac1aaea","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16106","last_updated":"2026-06-21T21:42:59Z","snapshot_observed_at":"2026-08-02T15:16:38.422811Z","submitted_at":"2024-10-21T15:34:44Z","title":"Statistical Inference for Policy Evaluation with Temporal Difference Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16106","snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"cited_paper":"/paper/2410.16106","citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:b888a2722948aa5cb36da21e70259ce3027ffd4b3a29230a69d6b0e0a02a637f","observation_id":"e9787906-6a60-4791-a668-1dbe51521b39","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13822","last_updated":"2026-05-21T08:10:44Z","snapshot_observed_at":"2026-07-06T20:39:15.111209Z","submitted_at":"2025-02-19T15:33:55Z","title":"Uncertainty quantification for Markov chain induced martingales with application to temporal difference learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13822","snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"cited_paper":"/paper/2502.13822","citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:d8e5589c3bc38dc08dda22f3c4180b42164a623fe8758bb7d586111eb9fbe968","observation_id":"ec52895d-3eef-4c6f-ae6a-6a4b5aea23dd","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:63b969eadc9dd32ee3db70aa6aef674d1930c3474d6941225f6f7eeb4bd0bb5c","observation_id":"26475023-e828-4efd-b22d-a599ed1d27b4","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:f6d2a4ac6ef824fa68c67777fd61d6e31d3c4faf7cddb8169ad125a9f0acc8a9","observation_id":"24e40699-3fbe-4511-a4e0-43a8c01621cd","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:e98c55bae59e8929d22711220f5eb370416d05f4a76710f38cc8e0d122f2d98f","observation_id":"28a12283-aa4e-4d7a-a508-8c32e222281a","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:063e1a91b0c53a875ebac71c14b41b4619e0f32e2ab9af06d5a6e97f8730c22e","observation_id":"13379e75-f844-49aa-bea0-ca9787439803","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Xie and Z","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:ee77afbd96fe3a7b93a750f7e8c3a872dc0134460181b20a6e857fde9b09f688","observation_id":"16118e4a-3613-41ee-8b0e-5b5fd4540016","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15057","last_updated":"2024-10-19T10:27:26Z","snapshot_observed_at":"2026-07-06T19:36:23.905725Z","submitted_at":"2024-10-19T10:27:26Z","title":"Asymptotic Time-Uniform Inference for Parameters in Averaged Stochastic Approximation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15057","snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"cited_paper":"/paper/2410.15057","citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:287a4e95f58d6fe5fd0b0cb101f69affb8ab65664541273f5067232210edd401","observation_id":"63585557-ae6b-4068-9fd5-5d82e28b115b","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13884","last_updated":"2024-01-25T02:01:53Z","snapshot_observed_at":"2026-07-06T17:20:11.913242Z","submitted_at":"2024-01-25T02:01:53Z","title":"Constant Stepsize Q-learning: Distributional Convergence, Bias and Extrapolation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13884","snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":"Zhang and Q","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"cited_paper":"/paper/2401.13884","citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:bed78a03a304a978b712e79e0c04a6c086ee1b6646ae398a39e32b8bfbf89713","observation_id":"82258d0c-a47d-4238-99e1-9b2d32e949e7","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:03cb28d3488066d2514eaa6f9fb40d4615a05da28bed97530eee1252113bda9b","observation_id":"c492daf8-189b-4c93-a1a2-8520e36ac9a2","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:dc5c6cedbc05c259a81111ec6c1a9dd9c3b6776b7e81fb57ba038f49a63d5c0f","observation_id":"1dfc15e8-f7b8-4b63-9913-6295fb474ff4","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","latest_version":1,"primary_category":"stat.ML","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization"},"reference_resolution":{"displayed":77,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":75,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":77},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 77 of 77 outbound references and 0 inbound Pith citation observations for arXiv:2604.04218."}