{"as_of":"2026-08-05T07:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:369d5b1f360127ce02a7f7353230aab8d8ddef55661a2acf5abc68e85b203602","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-19T22:11:31.021067Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.17678/citation-record","integrity":"/paper/2605.17678/integrity","json":"/paper/2605.17678/citation-record.json","paper":"/paper/2605.17678"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Residual algorithms: Reinforcement learning with function approximation","venue":null,"work_id":"7740df1b-123f-43d5-b998-329a7ac59906","year":1995},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:6a4abf2668faa0fc245fe4bcfb1d7bb5893329158acc6b863f0685db6b390c5b","observation_id":"40dc8837-f206-4680-b1e1-df640f0feb55","resolution":{"observed_at":"2026-05-19T22:12:51.813204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The reverse isoperimetric problem for gaussian measure.Discrete & Computational Geometry, 10(4):411–420","venue":null,"work_id":"e4f5d992-92af-405f-bd44-b7a85b0b2108","year":1993},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:3ba408b2b9b39d2c49f861dd1c597708fd91e6e7c9031db355ed27283fa3586f","observation_id":"e8fd7740-ff10-4615-8216-4925873df3e2","resolution":{"observed_at":"2026-05-19T22:12:51.804765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bertsekas and John N","venue":null,"work_id":"16043d2a-fad1-4af5-87e2-d17f27834c32","year":1996},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:f2013d23e75269de09a10afbbbd58410a90c537f07bee4c5c38796cd620525f9","observation_id":"f7ca4278-657f-4e1b-bae1-41d2c9ffa5bf","resolution":{"observed_at":"2026-05-19T22:12:51.767640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gaussian approximation for two-timescale linear stochastic approximation","venue":null,"work_id":"650395df-4448-4338-9dbb-5f6b8b6b0155","year":2026},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:22753d3d9d012bff8f538dad7024bda92dc61053cb6bc631be0c0afb19acdc09","observation_id":"b793ca98-8c8d-4389-b8a0-3146719a43bc","resolution":{"observed_at":"2026-05-19T22:12:51.743242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Finite-sample analysis of nonlinear stochastic approximation with applications in reinforcement learning.Automatica, 146:110623","venue":null,"work_id":"fd03ab28-49e8-48e5-91ba-b2f06ab6e9d5","year":2022},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:9864dba92e58b4ebfb5bff3a29736ef831a278e71e9551779329980265a8f9ba","observation_id":"cc8bc86e-9497-4ca0-9079-6039393f0183","resolution":{"observed_at":"2026-05-19T22:12:51.746999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gaussian approximations and multiplier bootstrap for maxima of sums of high-dimensional random vectors.The Annals of Statistics, 41(6):2786– 2819","venue":null,"work_id":"4ffa6c13-1013-42e2-923b-05541bf38dc4","year":2013},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:8f3b5f24609c225cda266f25eef438739ebd0b84689f0a24db67c7f329355ac5","observation_id":"1e6cdc81-af56-4c0f-8772-7b4556bec9c0","resolution":{"observed_at":"2026-05-19T22:12:51.757801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Springer Series in Operations Research and Financial Engineering","venue":null,"work_id":"1f5ec696-5faa-478f-9116-107998239d41","year":2018},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:d1a3cde2e984b5f183e0dddcdd96ad869a6b1cc8ac6193d7bfd0495b39daf676","observation_id":"b4adc09d-effc-437e-a05f-37b3b0c40497","resolution":{"observed_at":"2026-05-19T22:12:51.808946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Finite-time high-probability bounds for Polyak–Ruppert averaged iterates of linear stochastic approximation.Mathematics of Operations Research, 50(2):935–964","venue":null,"work_id":"70d18a42-f283-4d4a-86e6-77e7180e5efb","year":2025},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:5ebba9155acc7590443077cd6d5ed74b05703c1f1923d837dc350964c1a035c9","observation_id":"953102f2-f448-4b5c-a2f8-7e71798a057c","resolution":{"observed_at":"2026-05-19T22:12:51.845754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tight high probability bounds for linear stochastic approximation with fixed stepsize","venue":null,"work_id":"b942b78d-4932-4254-981f-744cd954c8a5","year":2021},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:a09f48bf6dcbf15ea2c8984a7b046af0c22a49016fc9828a4d11eb32dcfa1bec","observation_id":"df473692-34bd-485f-813a-a448034ce0fb","resolution":{"observed_at":"2026-05-19T22:12:51.739637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Online bootstrap confidence intervals for the stochastic gradient descent estimator.Journal of Machine Learning Research, 19(78):1–21","venue":null,"work_id":"6e3bcbdf-c27f-4d3c-aee5-619fdad0c064","year":2018},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:a1af688c2e781bb4d602244d572a07a7f938d26089666e9e0f8889130c832c71","observation_id":"6b744a31-b812-4c34-974b-9bc61127c235","resolution":{"observed_at":"2026-05-19T22:12:51.736485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reinforcement learning with deep energy-based policies","venue":null,"work_id":"fc61a764-34cf-411c-8d26-34d180e7c0cb","year":2017},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:c42e0063f91241cd7f74cdb7f898fc519e22879ef3abc1530600633c2a073716","observation_id":"118e68be-7a8c-4b6b-8384-8da4f7e80917","resolution":{"observed_at":"2026-05-19T22:12:51.733271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T14:37:16.199182Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","venue":null,"work_id":"860704d1-33cd-427d-95e5-8fa051fab1e8","year":2018},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:b1002f83c22f011a741a2379c884d5758ed2e4a8a2805f0772b00e61fb557a81","observation_id":"8a78efbe-f0f9-4a9e-9257-2068de33b18c","resolution":{"observed_at":"2026-05-19T22:12:51.826715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Is q-learning provably efficient? Advances in neural information processing systems, 31","venue":null,"work_id":"93bf1905-1c49-4409-8db9-86b4cbcdeb05","year":2018},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:10930a3d4cb9a48e42a259afa47cc888d905a331f4fef21b6d9297f0438b2103","observation_id":"060b5668-ee5c-47c2-8114-ba336ff908b2","resolution":{"observed_at":"2026-05-19T22:12:51.831286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kaledin, E","venue":null,"work_id":"d3163d09-f4fd-4284-8f32-0aa6de65cdf2","year":2020},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:82681e202ecdd29a8b12f13ab8a06edc2e8bb8ea60c9dabc4b756fe779c32bb8","observation_id":"e5583dc9-0ec9-450f-bbf1-94f4521dd244","resolution":{"observed_at":"2026-05-19T22:12:51.835145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Is q-learning minimax optimal? a tight sample complexity analysis.Operations Research, 72(1):222–236","venue":null,"work_id":"4c1d6c7f-31ce-4245-97e2-b060152b2cbb","year":2024},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:07ce1343d10b02b816e994c9f3d77358a713be7000831f67381d71e88226e8e6","observation_id":"209d5770-4039-46a5-bd9b-45f0152652ed","resolution":{"observed_at":"2026-05-19T22:12:51.838768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A statistical analysis of polyak-ruppert averaged q-learning","venue":null,"work_id":"ded04098-1b61-4987-bbde-6975a664fab4","year":2023},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:79e9d7e5212b7ae260932385cfa51a19c400f40672ba7dfd7264603ca0a9ce44","observation_id":"8fdd6c56-f3c0-42c5-80aa-07b7ecb3d492","resolution":{"observed_at":"2026-05-19T22:12:51.850007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.18964","last_updated":"2026-04-20T11:35:29Z","snapshot_observed_at":"2026-07-06T22:30:31.933240Z","submitted_at":"2025-09-23T13:16:14Z","title":"Central Limit Theorems for Asynchronous Averaged Q-Learning","version":3},"cited_work":{"arxiv_id":"2509.18964","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.18964","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Central Limit Theorems for Asynchronous Averaged Q-Learning","venue":"cs.LG","work_id":"a74f3960-4e8e-4a12-a8ad-98b07c578800","year":2025},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"cited_paper":"/paper/2509.18964","citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:76361bc6fcc733fbe7f1640fc15ebef5fefcc00803c4031f7c6f6f3720200603","observation_id":"32c7a4a3-69ac-4f90-b804-78312499e4dd","resolution":{"observed_at":"2026-05-19T22:12:50.608140Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An analysis of reinforcement learning with function approximation","venue":null,"work_id":"d9aed715-545b-45f3-b8f0-6d43d9b20b16","year":2008},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:1ca7cdccd1b430b9b5dc1c8515a06c11c6969891e96a68fdba27e2218a5d4d60","observation_id":"508b2578-7e2a-4c6c-99fe-e509461b06f3","resolution":{"observed_at":"2026-05-19T22:12:51.729484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T14:16:17.503024Z","title":"Human-level control through deep reinforcement learning.nature, 518(7540):529–533","venue":null,"work_id":"d4e26c64-e02e-4897-9145-bf955ae3116e","year":2015},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:86823cc93718cdb96b61406ee2e48d607934ed757145fe9f01abb668d151b779","observation_id":"aec18e48-b3ef-4c81-bc0a-4697f0443765","resolution":{"observed_at":"2026-05-19T22:12:51.858277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multivariate normal approximation on the wiener space: new bounds in the convex distance.Journal of Theoretical Probability, 35(3):2020–2037","venue":null,"work_id":"533c4aad-4851-4e50-befb-f86a9c40ecef","year":2020},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:8500c83194fc9c56b5af8785bcb706e332f291743462ee55e85d25d771059db2","observation_id":"1524fdd9-9188-4f63-9224-23e5be58d80c","resolution":{"observed_at":"2026-05-19T22:12:51.786266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Osekowski.Sharp Martingale and Semimartingale Inequalities","venue":null,"work_id":"f5b8e3a4-189b-4d94-87f0-963df8cf1f22","year":2012},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:4a1bda030e0d8746e912dfa992569584cc0395582b81b99cc5c8ce5433d02dd8","observation_id":"203198b1-8035-4630-a19b-f4f2075abb3f","resolution":{"observed_at":"2026-05-19T22:12:51.790140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Concentration inequalities for markov chains by marton couplings and spectral methods","venue":null,"work_id":"1c8e38ab-2552-4dc2-95f7-29e51c94819e","year":2015},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:9f9c91d0186caad9ca7932af8fff15416e8d3cb93e479b4f5f00c3569d842aa6","observation_id":"391bdb96-4866-4296-8740-321abfbab4fe","resolution":{"observed_at":"2026-05-19T22:12:51.800334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Acceleration of stochastic approximation by averaging.SIAM journal on control and optimization, 30(4):838–855","venue":null,"work_id":"e229dace-bf39-49be-8877-18a949273085","year":1992},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:c511f845fdc01bcc526190bc6b3af0b8133e257e865c9319529551e408ef8d76","observation_id":"7ecdfc75-5ad1-4064-827a-d3a3a54c8725","resolution":{"observed_at":"2026-05-19T22:12:51.818797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Finite-time analysis of asynchronous stochastic approximation and q-learning","venue":null,"work_id":"fda1823e-0928-4c06-8273-02ef2af19865","year":2020},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:f3aba3eb71dc46d4abb4dcc46b0c77850aab0eeccdb247481b3f1006d701d898","observation_id":"08116d00-f759-4f14-a3cd-8f3fb45178e3","resolution":{"observed_at":"2026-05-19T22:12:51.782504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.07323","last_updated":"2026-04-08T17:37:15Z","snapshot_observed_at":"2026-07-06T22:55:37.787732Z","submitted_at":"2026-04-08T17:37:15Z","title":"Gaussian Approximation for Asynchronous Q-learning","version":1},"cited_work":{"arxiv_id":"2604.07323","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.07323","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gaussian Approximation for Asynchronous Q-learning","venue":"stat.ML","work_id":"53fe7849-53bb-4b5b-9359-efc1cead6396","year":2026},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"cited_paper":"/paper/2604.07323","citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:942b863e6806378532d4b98eba00fe527452700d76bfb4cab9d68da9ce7c2046","observation_id":"67ac2044-f6d0-4135-b51c-555c9ef1d1c8","resolution":{"observed_at":"2026-05-19T22:12:50.631664Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient estimations from a slowly convergent Robbins-Monro process","venue":null,"work_id":"b1153e7f-98c5-42b1-a5df-f65a2fb8d522","year":1988},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:8f9fde8047ca4ea8019e493233ee47ea256be19bd70c72241a5c283e24afc9d2","observation_id":"d6e02392-db8d-41cf-a0d2-2aa2e02dc629","resolution":{"observed_at":"2026-05-19T22:12:51.778335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0f98cbc4-918a-4353-93e1-a7b76dd91bd5","year":2024},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:197af8fdd419027b575ca49406f11687c7d3255e793972954c283e9544d11b6c","observation_id":"0c601399-bcdc-4801-8343-901af607ff31","resolution":{"observed_at":"2026-05-19T22:12:51.793438Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Statistical inference for linear stochastic approximation with Markovian noise","venue":null,"work_id":"e3eef4f5-a8b7-4574-902a-a605be42a70f","year":2026},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:2c0b9a3611364cf9b434f334ba512addfd966eed6cccbbed54c238b2ca6f1e61","observation_id":"f04fa30c-eab2-4156-a128-fb3c51c39b69","resolution":{"observed_at":"2026-05-19T22:12:51.771205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Berry–Esseen bounds for multivariate nonlinear statistics with applications to M-estimators and stochastic gradient descent algorithms.Bernoulli, 28(3):1548–1576","venue":null,"work_id":"7ee8d729-4b28-4f75-9a33-8731c53c4774","year":2022},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:898f9e92814019b3b9e856ef30a0154191773df68b16083b4aaab9c322589b34","observation_id":"287755d5-24b7-4c62-95ec-aec4668ecaa3","resolution":{"observed_at":"2026-05-19T22:12:51.753827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06719","last_updated":"2026-05-04T10:50:33Z","snapshot_observed_at":"2026-07-06T20:34:06.899427Z","submitted_at":"2025-02-10T17:49:05Z","title":"Gaussian Approximation and Multiplier Bootstrap for Stochastic Gradient Descent","version":3},"cited_work":{"arxiv_id":"2502.06719","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.06719","snapshot_observed_at":"2026-07-01T21:46:15.184522Z","title":"Gaussian Approximation and Multiplier Bootstrap for Stochastic Gradient Descent","venue":"stat.ML","work_id":"06b8a6c9-a585-4e52-aeef-7148619d9cc0","year":2025},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"cited_paper":"/paper/2502.06719","citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:e44a7bfba7ab2ac8d5c0618f2f184b82adf547f2c7a9c1db2c4b0651b08acbdb","observation_id":"71f9fac5-4741-4776-bb68-87c373122e96","resolution":{"observed_at":"2026-05-19T22:12:50.620201Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bootstrap confidence sets under model misspecification.The Annals of Statistics, 43(6):2653 – 2675","venue":null,"work_id":"252e2c90-c65d-4f01-af67-9e479b80b19b","year":2015},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:87c1dff4c47dfaac5a3fca5072bd9ca10e64b471eb75791b8db5c69c94e9e886","observation_id":"a3f23be1-9570-484c-9e3a-1392e09de842","resolution":{"observed_at":"2026-05-19T22:12:51.842199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.445454Z","title":"Sutton and Andrew G","venue":null,"work_id":"34a41b4b-6488-46eb-93a5-911d8a963bbc","year":2018},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:9415e40b9e5b4fab919d732b74e7d547381917f6ec7a0e120821a4c551f7a67e","observation_id":"807db67d-64a3-43aa-a5bc-e3e3cb3bfd73","resolution":{"observed_at":"2026-05-19T22:12:51.822631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Asynchronous stochastic approximation and q-learning.Machine learning, 16(3):185– 202","venue":null,"work_id":"92824c6d-7a5c-4441-ae33-73822ab4ed7a","year":1994},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:e8e830c7d4c9b22374c7e83fbe17377dec15c1c7b495073053e2ba13762f1961","observation_id":"928aa72a-7791-42a8-a182-61fa991f91a7","resolution":{"observed_at":"2026-05-19T22:12:51.750525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04697","last_updated":"2019-08-08T17:33:58Z","snapshot_observed_at":"2026-07-06T07:59:34.794687Z","submitted_at":"2019-06-11T16:58:54Z","title":"Variance-reduced $Q$-learning is minimax optimal","version":2},"cited_work":{"arxiv_id":"1906.04697","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.04697","snapshot_observed_at":"2026-07-09T22:56:37.735104Z","title":"Variance-reduced q-learning is minimax optimal","venue":"cs.LG","work_id":"60497a6e-266a-42d8-9dd6-acc8d3171cc4","year":2019},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"cited_paper":"/paper/1906.04697","citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:7eaf697de5ecf8a39eaef74330527620ef06f2e4c7d8273e41b85b7898af7e9d","observation_id":"0ccccb12-8fc1-4a95-8d3b-35cbb733e050","resolution":{"observed_at":"2026-05-19T22:12:50.614532Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"037c2f83-0401-4d0c-8cb5-5e08c30a6f8b","year":1992},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:f1ebab609e3f29376bf58010091ad8c56dd55ff71be9bcf8de4fb00852ade616","observation_id":"e9aa5501-8d7d-48ef-82fe-75326dc04a31","resolution":{"observed_at":"2026-05-19T22:12:51.774620Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16106","last_updated":"2026-06-21T21:42:59Z","snapshot_observed_at":"2026-08-02T15:16:38.422811Z","submitted_at":"2024-10-21T15:34:44Z","title":"Statistical Inference for Policy Evaluation with Temporal Difference Learning","version":6},"cited_work":{"arxiv_id":"2410.16106","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.16106","snapshot_observed_at":"2026-06-23T03:13:09.455495Z","title":"Statistical Inference for Temporal Difference Learning with Linear Function Approximation","venue":null,"work_id":"aeaad93f-8e33-49d7-b7ea-ae6a23d879f6","year":2024},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"cited_paper":"/paper/2410.16106","citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:cb3dd86e95ee187e91e5071cc7bc13edbad96784dccfa8f074d69e57e5183466","observation_id":"f05ad8a7-7a48-4338-98e0-7b9bd8a13c8b","resolution":{"observed_at":"2026-06-23T03:13:09.455495Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13822","last_updated":"2026-05-21T08:10:44Z","snapshot_observed_at":"2026-07-06T20:39:15.111209Z","submitted_at":"2025-02-19T15:33:55Z","title":"Uncertainty quantification for Markov chain induced martingales with application to temporal difference learning","version":3},"cited_work":{"arxiv_id":"2502.13822","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.13822","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Uncertainty quantification for Markov chains with application to temporal difference learning","venue":null,"work_id":"6fa7e411-91e6-464d-9d45-cc8f8aec253e","year":2025},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"cited_paper":"/paper/2502.13822","citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:179ac94a84064c2c2bd542f86f3be1f6526a15e6d9bc0458e9fa2ee26d62d5fe","observation_id":"db2bb3f6-2fb8-4653-9f95-106f1d1bf2c8","resolution":{"observed_at":"2026-05-22T02:03:46.373087Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A statistical online inference approach in averaged stochastic approxi- mation.Advances in Neural Information Processing Systems, 35:8998–9009","venue":null,"work_id":"d3b8227a-9278-4001-b21b-d45dde5fced7","year":2022},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:8f8b96d900c03abb4250d6f141363e8996e77eacef9be10b9f3472ede290ecd9","observation_id":"79604292-4892-4c8c-bb2c-b000f8852e1f","resolution":{"observed_at":"2026-05-19T22:12:51.763463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Maximum entropy inverse reinforcement learning","venue":null,"work_id":"e8865cce-083a-425b-87d1-07eb42a3590f","year":2008},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:ddec9c39583372ed67cff1b08b6c4e6d161747130f66c52d36c6474f7c98de80","observation_id":"fe4d978b-8f79-439b-b12e-1b671735b0c2","resolution":{"observed_at":"2026-05-19T22:12:51.796753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Finite-sample analysis for sarsa with linear function approximation.Advances in neural information processing systems, 32","venue":null,"work_id":"a56373d0-2fe3-43fa-ba38-9bb983c22996","year":2019},"citing_paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:31.021067Z"},"links":{"citing_paper":"/paper/2605.17678"},"observation_digest":"sha256:1354578065e943fb145acc67947634888d6f772a2dc51a4ef9e12b1a59ddcb9d","observation_id":"f12d2792-203e-45b6-9acb-b1fe7603dd29","resolution":{"observed_at":"2026-05-19T22:12:51.854415Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.17678","last_updated":"2026-05-17T22:23:25Z","latest_version":1,"primary_category":"stat.ML","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:23:25Z","title":"On Gaussian approximation for entropy-regularized Q-learning with function approximation"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":2,"verified_exact":6,"verified_fuzzy":31},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2605.17678."}