{"as_of":"2026-08-07T08:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2fc84c432ea013a15b5dd098005174d8b523f59a18d61a8baf725556f814b9ad","coverage":[{"denominator":162,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:15:15.850895Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T10:46:25.335756Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.14444","snapshot_observed_at":"2026-07-13T10:46:25.335756Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.04218","last_updated":"2026-04-05T18:31:51Z","snapshot_observed_at":"2026-07-13T10:46:19.431432Z","submitted_at":"2026-04-05T18:31:51Z","title":"Sharp asymptotic theory for Q-learning with LDTZ learning rate and its generalization","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-13T10:46:25.335756Z"},"links":{"cited_paper":"/paper/2507.14444","citing_paper":"/paper/2604.04218"},"observation_digest":"sha256:a419e0c8d15a0ed1f948667cbcdde51a545aee51800597c6a7a7340586deec42","observation_id":"b012529b-b82f-4ebe-bc86-7eedd4dd0722","resolution":{"observed_at":"2026-07-13T10:46:25.335756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.14444/citation-record","integrity":"/paper/2507.14444/integrity","json":"/paper/2507.14444/citation-record.json","paper":"/paper/2507.14444"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.568377Z","title":"CS Dept., UW Seattle, Seattle, WA, USA, Tech","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.568377Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:b03e01c7464c1ef296547eb0aa5abe83e791a681c02071e78bb1124269160b53","observation_id":"12693451-7cd5-408e-802e-84f3cd7406ac","resolution":{"observed_at":"2026-08-06T16:15:15.568377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.572431Z","title":"Advances in neural information processing systems 33:20095–20107","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.572431Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:5f45eaa8a223ef14fcb9177da1b9b7e475188edea13ec4604c5ed731c20c9e6e","observation_id":"2fe14251-ff17-4bc4-8c1c-dd0d81d322b4","resolution":{"observed_at":"2026-08-06T16:15:15.572431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.575782Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.575782Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:d832a6a2a5b00533cc1e1c1da690837f277776df1d617eb48a22d3ab83938c0b","observation_id":"1a1d39a8-6379-45e1-8724-3890a2d9e279","resolution":{"observed_at":"2026-08-06T16:15:15.575782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.579021Z","title":"Journal of Machine Learning Research 22(98):1–76","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.579021Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:43fd89e632b3b615fbf28b0c86a4e36ec30e790d5b083dad658f76807b8e7744","observation_id":"b58f16cd-094b-42d3-8857-eaf9469b8cba","resolution":{"observed_at":"2026-08-06T16:15:15.579021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.582596Z","title":"Advances in neural information processing systems 19","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.582596Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:e45d10729ccf53b61850033da87e1d8f67fff62107984b40289ef36613cf290c","observation_id":"218e35f8-f1b0-4007-8213-c796eb9579e0","resolution":{"observed_at":"2026-08-06T16:15:15.582596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.585913Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.585913Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:a2ec0d4c171124a89cf77962c4c9b9c89bdec2b5c6f3b29780fa571c16e0fb7d","observation_id":"164cdbcc-c8bf-408d-9b11-c58544263029","resolution":{"observed_at":"2026-08-06T16:15:15.585913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.589749Z","title":"International Conference on Machine Learning , 263–272 (PMLR)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.589749Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:3b42887521f80551312814fc1018c7428787896ae3a3d962cc3df5eec882505e","observation_id":"3c93fe29-13c3-4d98-9759-9ca2f9be3364","resolution":{"observed_at":"2026-08-06T16:15:15.589749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.592467Z","title":"Systems & control letters 61(12):1203–1208","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.592467Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:e8ae9a56b82b7f5914fef909c2daa2dbe3a2790edd19bb043314115423b01ce0","observation_id":"ac69a5cc-b15f-47a4-a5f4-68c53b0d3277","resolution":{"observed_at":"2026-08-06T16:15:15.592467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.595603Z","title":"Proceedings of the National Academy of Sciences of the United States of America 38(8):716","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.595603Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:39a4c9be3d31699fe0c0f4508044c7f4ceca9846d27a7c7b2903359e0b243785","observation_id":"45717872-6b3d-4d15-85ee-92d39de1db7d","resolution":{"observed_at":"2026-08-06T16:15:15.595603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.598900Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.598900Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:2c25edfdca6b18044f0696a4c01fed7196afeae1a0c8ad563851725b33becf1c","observation_id":"c10e113f-0523-4bf7-a256-8d9be687dd17","resolution":{"observed_at":"2026-08-06T16:15:15.598900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.601779Z","title":"Mathemat- ical Programming 167(2):235–292","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.601779Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:a8bd2162cc4560113809c9c3bbe14f494ac8aacffc3aeea7d1d971ee25f31b0f","observation_id":"c1ccb9a8-96e6-4b7f-8424-9ce10fcd2a67","resolution":{"observed_at":"2026-08-06T16:15:15.601779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.604774Z","title":"Management Science 65(2):604–618","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.604774Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:541a2c78cc2aa0a0203a63c614afa69ce4515bd2214054e32137edfeb1dbb336","observation_id":"619c8f36-1be3-42f9-8a02-fa61d17b76c7","resolution":{"observed_at":"2026-08-06T16:15:15.604774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.607513Z","title":"International Conference on Artificial Intelligence and Statistics , 2386– 2394 (PMLR)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.607513Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:2caa3c0195d72f7692e3a4dde250ae39f9c5656b4757ee341ff305970a3156d1","observation_id":"5573b5ee-9447-4ea7-adf7-bd74db139714","resolution":{"observed_at":"2026-08-06T16:15:15.607513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.610598Z","title":"Operations Research 72(5):1906–1927","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.610598Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:9d0a7bcbac134b73edee7e453c9d5c624cec4a3757e61d4e3f9f1dbbdf28352b","observation_id":"ce827f2d-70fa-45a4-8dfc-88488d2f0656","resolution":{"observed_at":"2026-08-06T16:15:15.610598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.613430Z","title":"Operations Research 69(3):950–973","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.613430Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:d4c02badd9669953423c9d09d6f2fd1a287cbc92a19a4405e21d6048a630ad44","observation_id":"38973305-f761-42f6-a3af-6a7f523857a4","resolution":{"observed_at":"2026-08-06T16:15:15.613430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.616000Z","title":"Mathematics of Operations Research 44(2):565–600","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.616000Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:326b8293a53e78074d04222d516f5083ba86d927c69a1c7d45bef5cc418f2924","observation_id":"0b98b1da-9ce1-45e8-9cd0-0fac68ea4ee0","resolution":{"observed_at":"2026-08-06T16:15:15.616000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.618901Z","title":"International Conference on Machine Learning , 1056–1066 (PMLR)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.618901Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:508d0cd81af74b169b3d08d9b90055b2036d78dd87f1c395264bed9c2a560c86","observation_id":"f12e40e0-a906-487f-8a2f-8834cf4e48cb","resolution":{"observed_at":"2026-08-06T16:15:15.618901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.621807Z","title":"the method of paired comparisons","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.621807Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:20f434cfdb9f0b656fcd36de4515de59b298c69e286bbf449d15b636086b7fe4","observation_id":"e5f4bb39-e95a-4a5e-92c9-e9163c58fb12","resolution":{"observed_at":"2026-08-06T16:15:15.621807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.624549Z","title":"2022 IEEE 61st Conference on Decision and Control (CDC) , 2833–2838 (IEEE)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.624549Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:78ba47ecc3ad4484a80455a0c3bcbfc8b4cf6fafd4541b7493c01f2756268eb1","observation_id":"5c900be5-fdee-45a8-bf66-a84061a09017","resolution":{"observed_at":"2026-08-06T16:15:15.624549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.627194Z","title":"Operations Research 70(4):2563– 2578","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.627194Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:b2eb24ab97a5ac5c61ccf8e7adbe088e53136372c7f7d4d170cc084a8d8324c5","observation_id":"4aa3a470-cb49-4e0c-81d6-19c269613c8f","resolution":{"observed_at":"2026-08-06T16:15:15.627194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.630359Z","title":"The Eleventh International Conference on Learning Representations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.630359Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:814d16a55d2eb2569698e664b5110a80c4fb17c85efcfc21977567be9e34d746","observation_id":"17a364c8-80c2-4674-ba99-80716f2b0381","resolution":{"observed_at":"2026-08-06T16:15:15.630359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.633188Z","title":"The Thirteenth International Conference on Learning Representations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.633188Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:009de95957ee10bf5ff3f813a76b650375609542471fcb8e2a4c56d65635ee79","observation_id":"bc4cfaa9-d03e-40ab-9887-1a87081dfdd6","resolution":{"observed_at":"2026-08-06T16:15:15.633188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.636473Z","title":"Journal of Machine Learning Research 25(4):1–48","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.636473Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:1edced1ae0c06771bd6a3069c1731173b53c63213e0af6e4d5846cff3bff44cb","observation_id":"48b82d19-3fb8-4c84-9469-4077e9b9aa8a","resolution":{"observed_at":"2026-08-06T16:15:15.636473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.639126Z","title":"Advances in neural information processing systems 30","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.639126Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:d21e082c9f266ce428fff93a2db2bb5fc06386763065cb32bbb828dc2d8a8438","observation_id":"77042f5f-0b78-404d-a29c-ea7c816de9fd","resolution":{"observed_at":"2026-08-06T16:15:15.639126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.641900Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.641900Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:aaf6ebd7e88558d43fa2ba7280d5f8c9863349e2a95d5faef4ea6ecfe855e5a2","observation_id":"5b3b6c3f-76ee-442d-833c-852d9512156a","resolution":{"observed_at":"2026-08-06T16:15:15.641900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.645160Z","title":"The Annals of Statistics 53(1):426–456","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.645160Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:6675fc9233bb6763c084618e669c4d1aa00ee70d7ee4ec741ade50e996432150","observation_id":"dcb15948-03b4-4caa-861f-8901ab6364a3","resolution":{"observed_at":"2026-08-06T16:15:15.645160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.647900Z","title":"International Conference on Machine Learning , 1042–1051 (PMLR)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.647900Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:1458a3f2163975573f22e5c27ff818b0d818d65cd07de268cfcea3722a497e8f","observation_id":"65d94137-b842-411f-88cb-6cd8608abd07","resolution":{"observed_at":"2026-08-06T16:15:15.647900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.00874","last_updated":"2021-06-30T13:09:14Z","snapshot_observed_at":"2026-07-06T08:54:34.491642Z","submitted_at":"2020-02-03T16:42:01Z","title":"Finite-Sample Analysis of Stochastic Approximation Using Smooth Convex Envelopes","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.00874","snapshot_observed_at":"2026-08-06T16:15:15.650820Z","title":"arXiv preprint arXiv:2002.00874","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.650820Z"},"links":{"cited_paper":"/paper/2002.00874","citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:f5c416a23fa8543f43a1fe08a679fd574d05633f0562c5bbc40261604c6db681","observation_id":"7cc32cb6-b0b1-4ecb-baf2-41192b31f171","resolution":{"observed_at":"2026-08-06T16:15:15.650820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.01567","last_updated":"2023-09-04T20:15:15Z","snapshot_observed_at":"2026-07-06T10:37:50.467703Z","submitted_at":"2021-02-02T15:48:19Z","title":"A Lyapunov Theory for Finite-Sample Guarantees of Asynchronous Q-Learning and TD-Learning Variants","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.01567","snapshot_observed_at":"2026-08-06T16:15:15.653672Z","title":"arXiv preprint arXiv:2102.01567","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.653672Z"},"links":{"cited_paper":"/paper/2102.01567","citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:c04f52e423299b0ff3d9011c41860bc855eefe867679dbcbfd69427fbaaca31e","observation_id":"067d16b7-c757-4fb4-ad9c-3064f461fe02","resolution":{"observed_at":"2026-08-06T16:15:15.653672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14208","last_updated":"2025-02-20T02:39:37Z","snapshot_observed_at":"2026-08-04T03:30:28.222833Z","submitted_at":"2025-02-20T02:39:37Z","title":"A Non-Asymptotic Theory of Seminorm Lyapunov Stability: From Deterministic to Stochastic Iterative Algorithms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14208","snapshot_observed_at":"2026-08-06T16:15:15.656586Z","title":"arXiv preprint arXiv:2502.14208","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.656586Z"},"links":{"cited_paper":"/paper/2502.14208","citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:a2bc371c61ab903d9697aba8e222db45c89af2df3118b2965de081d2f716101c","observation_id":"ddfc3f08-603d-42f4-be74-81ef18d9c46b","resolution":{"observed_at":"2026-08-06T16:15:15.656586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.659874Z","title":"Advances in Neural Information Processing Systems 37:1750–1810","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.659874Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:d774b41e18192cfd5eb0000aedaf00e494f499d10df7b5548fd5c82a5fd4a8d8","observation_id":"00e68bf7-7e69-460b-8d0d-056198a81de3","resolution":{"observed_at":"2026-08-06T16:15:15.659874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.662819Z","title":"Thirty-seventh Conference on Neural Informa- tion Processing Systems","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.662819Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:76a54951dddb16077a7a3474185b7a8e109a170859fcb7d59604c1ed6be32afb","observation_id":"68a30ee7-11c0-4080-b444-3ca23fa47e20","resolution":{"observed_at":"2026-08-06T16:15:15.662819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.665426Z","title":"Algorithmic Learning Theory , 578–598 (PMLR)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.665426Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:413c8d1ec206b2f618a3d0cddf5735cde0f88ada9daa7af9348f371a4b2fd1fa","observation_id":"bd11732f-6a12-4c64-9a47-248a3901ee7c","resolution":{"observed_at":"2026-08-06T16:15:15.665426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.09311","last_updated":"2019-09-27T02:09:54Z","snapshot_observed_at":"2026-07-06T07:29:14.938525Z","submitted_at":"2019-01-27T03:44:42Z","title":"Q-learning with UCB Exploration is Sample Efficient for Infinite-Horizon MDP","version":2},"cited_work":{"arxiv_id":"1901.09311","doi":null,"metadata_source":"pith","pith_arxiv_id":"1901.09311","snapshot_observed_at":"2026-08-06T16:15:16.199680Z","title":"Q-learning with UCB Exploration is Sample Efficient for Infinite-Horizon MDP","venue":"cs.LG","work_id":"54822cea-2269-49e2-b852-713076c8b770","year":2019},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.669216Z"},"links":{"cited_paper":"/paper/1901.09311","citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:8f35bd224ee97f2e7641b7ed76127fd63c2404b0ab8eb8f10c105bbb03e43810","observation_id":"adca8aff-9532-4ec8-85aa-12f2d1a0e8a3","resolution":{"observed_at":"2026-08-06T16:15:16.203077Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.10897","last_updated":"2021-07-11T22:29:02Z","snapshot_observed_at":"2026-08-06T06:27:35.315901Z","submitted_at":"2021-03-19T16:34:20Z","title":"Bilinear Classes: A Structural Framework for Provable Generalization in RL","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.10897","snapshot_observed_at":"2026-08-06T16:15:15.672091Z","title":"arXiv preprint arXiv:2103.10897","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.672091Z"},"links":{"cited_paper":"/paper/2103.10897","citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:be2f4b612e54d1f315becc62dddf50c778426cd5f437918cefef1708d82f90ef","observation_id":"c0d3bcea-a478-43e1-8754-535767a3c107","resolution":{"observed_at":"2026-08-06T16:15:15.672091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.675019Z","title":"The Annals of Statistics 49(3):1378–1406","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.675019Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:7157d4199e10bcf1b8f9609f5ceb81ea9d664033f73b0b9cd98045d03f0f5544","observation_id":"120fdbc4-e8eb-46f1-aa2a-bac11f48c4c3","resolution":{"observed_at":"2026-08-06T16:15:15.675019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.677860Z","title":"Journal of machine learning Research 5(Dec):1–25","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.677860Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:4654e6bfd5158b9d9f182ac48b7bed54c12b486b057cf5aead9271207336f3c8","observation_id":"c68b7e45-697b-4470-a7a9-4fa2a735d3f6","resolution":{"observed_at":"2026-08-06T16:15:15.677860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.680580Z","title":"International conference on machine learning, 1467–1476 (PMLR)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.680580Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:32440de8cd53695c9091204451590b7b244dff453b446470e651266a620aed89","observation_id":"0980d5a1-9f25-4414-b556-a09c96c08a38","resolution":{"observed_at":"2026-08-06T16:15:15.680580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.13487","last_updated":"2023-07-11T16:47:42Z","snapshot_observed_at":"2026-07-06T12:22:32.240903Z","submitted_at":"2021-12-27T02:53:44Z","title":"The Statistical Complexity of Interactive Decision Making","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.13487","snapshot_observed_at":"2026-08-06T16:15:15.683085Z","title":"arXiv preprint arXiv:2112.13487","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.683085Z"},"links":{"cited_paper":"/paper/2112.13487","citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:3624232a5f1490ddfbe377bf49431a0d8a21418f9fceb6f464275020711380a9","observation_id":"87b205ca-c24e-4ca0-8376-572f95508cd7","resolution":{"observed_at":"2026-08-06T16:15:15.683085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.685895Z","title":"Operations Research 71(6):2291–2306","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.685895Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:31372a68247276152695f76d24d45874e378415573b7641120c43f1bd8cc26f2","observation_id":"ee3a6a52-4683-45a7-8b86-9a2b453bf786","resolution":{"observed_at":"2026-08-06T16:15:15.685895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.688671Z","title":"Advances in neural information processing sys- tems 23:2613–2621","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.688671Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:3871cfd60bb97398974916cb4966d8bf9ce738427b05752a5123149671841904","observation_id":"1833bfe8-ebd1-4a3b-a8c4-f0616d57827a","resolution":{"observed_at":"2026-08-06T16:15:15.688671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.691313Z","title":"International Conference on Machine Learning , 12790–12822 (PMLR)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.691313Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:52874e1b229729db79f08062ba253ab51fba792178be71ed972e6e1666ddb56f","observation_id":"b0cd9721-5fbf-45a1-990b-56f3627f5469","resolution":{"observed_at":"2026-08-06T16:15:15.691313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.693866Z","title":"Mathematics of Operations Research 30(2):257–280","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.693866Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:68033bcc3dc16d2e035a2919c71974095696f73f5a5db411b4058bc8e4d70934","observation_id":"a2356951-8c33-4ec8-8520-daec7a9f2595","resolution":{"observed_at":"2026-08-06T16:15:15.693866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.696679Z","title":"Journal of Machine Learning Research 11:1563–1600","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.696679Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:2081b234a8b5647164406dfe53c68fccf915fa703bfcd47e5e1c303c9952e417","observation_id":"3644e780-3a6e-426a-9fc4-c14cb33110c6","resolution":{"observed_at":"2026-08-06T16:15:15.696679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.699236Z","title":"Advances in neural information processing systems 36:80674–80689","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.699236Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:90391ee6375c1479132d817e8df53f147046f40eb7a24992a84866dafdfa5f15","observation_id":"c08b3e32-668a-4811-b53c-961dcb296400","resolution":{"observed_at":"2026-08-06T16:15:15.699236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.702414Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.702414Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:6b6635b38f7033f7548b530769c526573229062b6abde53bf62e188c500d1314","observation_id":"cbd95dce-b202-43c5-a955-c69a785c2fc8","resolution":{"observed_at":"2026-08-06T16:15:15.702414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.704872Z","title":"International Conference on Machine Learning , 4870–4879 (PMLR)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.704872Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:85e1405ef8592e34abb572e8e60eecd95b37f0d012488741bce9b7d0f4c8ecca","observation_id":"7c41e9f2-608d-4238-85d4-bb11ea4971dc","resolution":{"observed_at":"2026-08-06T16:15:15.704872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.707540Z","title":"Advances in neural information processing systems 34:13406–13418","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.707540Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:24d3dd5e3bdd08ca058ed5b0da6215e6f75007e736113d53c76c2812af21083a","observation_id":"6429a0f9-983a-42cb-8f49-402fd2420247","resolution":{"observed_at":"2026-08-06T16:15:15.707540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.710001Z","title":"Conference on Learning Theory , 2137–2143 (PMLR)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.710001Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:0e07fe8e76889b74e9cf3c4f7d158272c21c84719d0ae75024ecc2b1a16a32eb","observation_id":"33f1fb05-9c22-4701-925e-4a7118ceb632","resolution":{"observed_at":"2026-08-06T16:15:15.710001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12952","last_updated":"2024-05-21T17:28:06Z","snapshot_observed_at":"2026-07-06T18:17:25.642584Z","submitted_at":"2024-05-21T17:28:06Z","title":"Truncated Variance Reduced Value Iteration","version":1},"cited_work":{"arxiv_id":"2405.12952","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.12952","snapshot_observed_at":"2026-08-06T16:15:16.168099Z","title":"Truncated Variance Reduced Value Iteration","venue":"cs.LG","work_id":"a6fb707f-2dfa-426d-9d1b-f31d5490a059","year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.712851Z"},"links":{"cited_paper":"/paper/2405.12952","citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:f46fafece08c91ba6fb0e2c34308c74a4b81404216a7af38cff986bef768ff48","observation_id":"677e47ea-b9fb-4f06-bf79-4917285a202e","resolution":{"observed_at":"2026-08-06T16:15:16.171403Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09900","last_updated":"2025-06-05T01:50:31Z","snapshot_observed_at":"2026-08-04T20:05:34.384992Z","submitted_at":"2022-12-19T22:43:08Z","title":"Policy learning \"without\" overlap: Pessimism and generalized empirical Bernstein's inequality","version":4},"cited_work":{"arxiv_id":"2212.09900","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.09900","snapshot_observed_at":"2026-08-06T16:15:16.154853Z","title":"Policy learning \"without\" overlap: Pessimism and generalized empirical Bernstein's inequality","venue":"cs.LG","work_id":"c7bda10d-3663-4a5d-9010-b07e13d9d6cc","year":2022},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.715810Z"},"links":{"cited_paper":"/paper/2212.09900","citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:a325e3b0820f40c027d66e320d5faabce59f71c0551d45af1711a8d344a47364","observation_id":"f949fb1b-dc6e-4789-859f-63169b561092","resolution":{"observed_at":"2026-08-06T16:15:16.158454Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.718629Z","title":"International Conference on Machine Learning , 5055–5064 (PMLR)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.718629Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:fb1b55e9bc030819cdf1449543120f20bf3d5ed1e4f91956698e6bd1a005ef65","observation_id":"1e43d55b-b08e-401e-88d1-76b69a147cd2","resolution":{"observed_at":"2026-08-06T16:15:15.718629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.721328Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.721328Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:a372e4c54662a29261385f19f62f59f4da5752c71f86f7618ee4033fe71cecf5","observation_id":"5554fea2-2587-4baf-9d57-0f1080817287","resolution":{"observed_at":"2026-08-06T16:15:15.721328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.723876Z","title":"Advances in neural information processing systems , 315–323","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.723876Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:cdf2e4884450c412c1e9c2ca7df4aba9998446bb7a2d3386be638ca397c7ee07","observation_id":"b28c4f96-27c9-4490-8466-9fcd0e7c932c","resolution":{"observed_at":"2026-08-06T16:15:15.723876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.726348Z","title":null,"venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.726348Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:1e009a424a484a74544c8a7ac236fcb0679e382011458d3b6e6e36ac27a2ccee","observation_id":"f8510dad-89c5-495d-9802-f7cebb0342b4","resolution":{"observed_at":"2026-08-06T16:15:15.726348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.729125Z","title":"Advances in neural information process- ing systems , 1531–1538","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.729125Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:923c50960a4329ca55fcb478f39ba965aae7dabeb07c82dcd92005db741ab6d2","observation_id":"58efa114-0175-4882-bc56-0db3b904a02a","resolution":{"observed_at":"2026-08-06T16:15:15.729125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.731783Z","title":"Advances in neural information processing systems , 996–1002","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.731783Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:1fbb0a735ec509645852e262bc9580e2dde15ae0b9cbe180c6ae4a2fac7abed0","observation_id":"db0b6f4c-6d30-438d-89ff-066c277f0666","resolution":{"observed_at":"2026-08-06T16:15:15.731783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.734332Z","title":"SIAM Journal on Math- ematics of Data Science 3(4):1013–1040","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.734332Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:ce7d59f26d258fb372f30ed5556a632f68ff47c0ce0ea7afdb244b16b4962983","observation_id":"7eb07294-e04f-419d-8d46-6c16c57f585d","resolution":{"observed_at":"2026-08-06T16:15:15.734332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.736951Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.736951Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:10b9825d601e371e0266341447a0e3b8d74955be5ea5bf766b4aa1511fc524f5","observation_id":"6d59be80-373a-41e6-b7bf-2f842b4560c3","resolution":{"observed_at":"2026-08-06T16:15:15.736951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.739408Z","title":"IEEE Transactions on Automatic Control 27(1):137–146","venue":null,"work_id":null,"year":1982},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.739408Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:efc223217875c74d69e7005a7cc8815f9b2e78c7392463f4aeee0b1ceddf5be5","observation_id":"231935af-ec32-4e6a-8ec6-05a9549586f4","resolution":{"observed_at":"2026-08-06T16:15:15.739408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.741940Z","title":"Advances in applied mathematics 6(1):4–22","venue":null,"work_id":null,"year":1985},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.741940Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:63267f4c8350f7877eb316435baa0f4f6d07349716248e87f2d5dbc93f2e5f17","observation_id":"d3cf1e35-b9f5-456b-801d-61730d3ed36b","resolution":{"observed_at":"2026-08-06T16:15:15.741940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.744401Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.744401Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:01e37e9f216f88216f332ec27bfa91e2c9bd7dbeb445a8a98ceac9622b93df04","observation_id":"2d65c4ff-4309-4e1b-9d06-4e960aee8b1b","resolution":{"observed_at":"2026-08-06T16:15:15.744401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.747001Z","title":"Reinforcement learning, 45–73 (Springer)","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.747001Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:98d374ac1b48eb3c79e6697ec3d4981f158c6b69ddfed767bb22de55b519d882","observation_id":"8b0b23a6-1835-4e94-9189-a25968bffa40","resolution":{"observed_at":"2026-08-06T16:15:15.747001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.749643Z","title":"International Con- ference on Algorithmic Learning Theory , 320–334 (Springer)","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.749643Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:57a621eccb967dc92aa4e8207b7e26e22ce2a7a45710f2d5640c9dc1ca5f41a9","observation_id":"1f0efe3a-3d01-4f72-a226-185d11a3fd50","resolution":{"observed_at":"2026-08-06T16:15:15.749643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.752335Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.752335Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:1e6486f914437fcb4c22c71599ce6bb8e7bca8d1fbf620c34e994eae59043b9e","observation_id":"7ae971a1-eb4e-4184-b555-a817de7eb4ba","resolution":{"observed_at":"2026-08-06T16:15:15.752335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-06T16:15:15.754970Z","title":"arXiv preprint arXiv:2005.01643","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.754970Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:12de3f5119ecfc2952f20f9822a3574be3150e35ff2f8b7c928cd56ef636298b","observation_id":"29d3c5a0-3d60-47ff-9d3e-98def9604053","resolution":{"observed_at":"2026-08-06T16:15:15.754970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.757950Z","title":"Operations Research 72(1):222–236","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.757950Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:fa757d2f6b605a4ce2f873da4241a01e50deea0511b509ae54d66d145aa89096","observation_id":"76e99e63-077b-4b42-a938-e929252dc9e3","resolution":{"observed_at":"2026-08-06T16:15:15.757950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.760540Z","title":"Advances in Neural Information Processing Systems , volume 35, 15353–15367","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.760540Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:0aac6d611e6f0238fee58d9cc548e2023f80c7eeac9e3b70a2959ed88316e712","observation_id":"365b5c58-e2d5-4bbc-bdd7-a4452d0be9f9","resolution":{"observed_at":"2026-08-06T16:15:15.760540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.762992Z","title":"The Annals of Statistics 52(1):233–260","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.762992Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:5ef6ccd5b80cf2297cf3de1c6acb7176632d1878b06396698c10ebc8c4bf531c","observation_id":"16202a1e-bc48-4efc-be55-a7f6c3b4a16b","resolution":{"observed_at":"2026-08-06T16:15:15.762992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.765580Z","title":"Advances in Neural Information Processing Systems 34","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.765580Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:b6d6d12cc680c2e1a6e6e87c2e311ed32e8885d4509e1b68b315b534f0b6f520","observation_id":"43384b55-aee6-4b60-88a2-fa7b73a8955a","resolution":{"observed_at":"2026-08-06T16:15:15.765580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.768171Z","title":"Mathematical Programming 1–96","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.768171Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:7616b796b0af62240164dd5c005cd520e3893b22048857095d864a5ee62670a6","observation_id":"889b26fb-6ef1-4c17-9f19-be97bcce130d","resolution":{"observed_at":"2026-08-06T16:15:15.768171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.770763Z","title":"Operations Research 72(1):203–221","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.770763Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:0aecc1ff641c57795e36e5b4e5e576f385694d4f7f238ae5236b8e8e076c8dab","observation_id":"5afca019-fc67-43b4-846a-d16463f74b49","resolution":{"observed_at":"2026-08-06T16:15:15.770763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.773621Z","title":"Advances in neural information processing systems 33:12861–12872","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.773621Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:c413a30392153949d7459cb7d508e2ebb00c73896332fea134459a71c0097d96","observation_id":"2676757a-1ae5-4152-89f1-aa9038b4a097","resolution":{"observed_at":"2026-08-06T16:15:15.773621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.776421Z","title":"IEEE Transactions on Information Theory 68(1):448–473","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.776421Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:d5ca7fbd9e9f3b38606c6ac4585cf089c5f5e9989c13cd1ae25585610274ef64","observation_id":"41f19b95-c669-42da-9205-b65746c4e5b2","resolution":{"observed_at":"2026-08-06T16:15:15.776421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.779018Z","title":"The Thirty Seventh Annual Conference on Learning Theory , 3431–3436 (PMLR)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.779018Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:e913b07a0e8d47945b63f3a7f17b37ca6f711309357b5eceaf0c7c5cf13f1f42","observation_id":"c894203d-872e-4178-a99e-5c11c8ca0cd6","resolution":{"observed_at":"2026-08-06T16:15:15.779018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.781667Z","title":"Advances in Neural Information Processing Systems 36","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.781667Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:2da82931b7158095692e7c7db7e0c2d420c0805804e2ea713768365da9a16773","observation_id":"0b224d95-7049-47cb-a3d2-680bede3cb6a","resolution":{"observed_at":"2026-08-06T16:15:15.781667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.784390Z","title":"International Conference on Machine Learning , 6248–6258 (PMLR)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.784390Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:fed3128d19e2f34d6f1d3b53b375e6321cf44647cebee2ae16495daaaabce905","observation_id":"c4385664-923b-41a0-9d53-f1c24af0a41c","resolution":{"observed_at":"2026-08-06T16:15:15.784390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.787425Z","title":"Games and economic behavior 10(1):6–38","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.787425Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:dcd7a3e1edc171988e140d57782ca7b081e8bea996a581cc52c44ad6afa44c4a","observation_id":"6e9afc94-0d5e-4aca-86c8-c30dc179330a","resolution":{"observed_at":"2026-08-06T16:15:15.787425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.790417Z","title":"International Conference on Machine Learning , 6820–6829 (PMLR)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.790417Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:01b71bb500b818a87968ecf9bb95f7f6717427f2c364fc18ba170050bc1a5f4d","observation_id":"86485cd9-1eb1-4e62-b2e9-a36ef0a60f4a","resolution":{"observed_at":"2026-08-06T16:15:15.790417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.793166Z","title":"Conference on Learning Theory, 2947–2997 (PMLR)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.793166Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:5a94df9d2c3679716489890a8006fb28b2cc6a5bdf07b8607922fe7340f2cc04","observation_id":"cfeff9aa-4b04-4544-a3db-bba947385458","resolution":{"observed_at":"2026-08-06T16:15:15.793166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.795858Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.795858Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:af0b97d6f3e5c3cdaa1e5e9514031f1449841402adb76a56f40698375bbb4fa6","observation_id":"f0fcbd82-6ce0-4076-9479-5f58eeac5fba","resolution":{"observed_at":"2026-08-06T16:15:15.795858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.798817Z","title":"Operations Research 53(5):780–798","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.798817Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:2771077fb033793eec78b77dcc3f8b572426aefa0b7c921f0fd784f4c9ac62e8","observation_id":"d72d4ffb-933b-4980-9b1f-c809a5f249d4","resolution":{"observed_at":"2026-08-06T16:15:15.798817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.801688Z","title":"(2022) Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.801688Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:015c4a694a0d89a5cd333dbf25a0d0155abce9e5cc24b65c179e8f918d58a789","observation_id":"40774393-8e86-4690-b0fa-52b10eef868c","resolution":{"observed_at":"2026-08-06T16:15:15.801688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.804449Z","title":"International Conference on Artificial Intelligence and Statistics, 9582–9602 (PMLR)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.804449Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:816387c59e12b938ecb4f2e96edaeec4f52ba09caad0d9e2c07d4d295063a31b","observation_id":"7f96ae58-f510-49b4-9af8-4c014d53ea7c","resolution":{"observed_at":"2026-08-06T16:15:15.804449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.807408Z","title":"IEEE Transactions on Information Theory 67(1):566–585","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.807408Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:36f74efe0b93d4dc518bbc25ec4347870d7e06074a453702780560930cb846f3","observation_id":"480562cf-e498-4aed-b5a0-4e3156a11dba","resolution":{"observed_at":"2026-08-06T16:15:15.807408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.01387","last_updated":"2023-04-19T00:30:20Z","snapshot_observed_at":"2026-08-06T06:46:08.345068Z","submitted_at":"2022-03-02T20:05:11Z","title":"A Survey on Offline Reinforcement Learning: Taxonomy, Review, and Open Problems","version":3},"cited_work":{"arxiv_id":"2203.01387","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.01387","snapshot_observed_at":"2026-08-06T16:15:16.130645Z","title":"A Survey on Offline Reinforcement Learning: Taxonomy, Review, and Open Problems","venue":"cs.LG","work_id":"c9c28b61-fdd7-4ef3-ad18-c69865d85e87","year":2022},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.810157Z"},"links":{"cited_paper":"/paper/2203.01387","citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:67b3764984539ffd3d6d33d02dff702c57f5db116e98cb7ff369c9316e8e2322","observation_id":"29a58c46-9992-482f-9d3c-f74b71cdbdf2","resolution":{"observed_at":"2026-08-06T16:15:16.134078Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.812922Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.812922Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:c98f2a3d18b090d94e0715a22d87ebac35c6a899344b112053c7dac717f309cb","observation_id":"2e51058d-276c-4991-9ef1-1241da4fe643","resolution":{"observed_at":"2026-08-06T16:15:15.812922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.816021Z","title":"Conference on Learning Theory 3185–3205","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.816021Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:603dfbc8a83f7b8039cc633830d84b1708c5a0c5a69721f4f9502820f1ffe9d4","observation_id":"30e65d9d-c35e-48cd-a829-0a74a531f6cf","resolution":{"observed_at":"2026-08-06T16:15:15.816021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.818702Z","title":"Advances in Neural Information Processing Systems 36","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.818702Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:78197ea8a2eb6e508f459525ab45dfa2f24631a87e2b18f26cbb2584444e8706","observation_id":"3b8033e1-1767-48d8-ac46-09c54e5dc3f4","resolution":{"observed_at":"2026-08-06T16:15:15.818702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.821727Z","title":"IEEE Transactions on Informa- tion Theory 68(12):8156–8196","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.821727Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:1c07f4bf6557ca5e2dc4fd8f319381d87f83736973e74d08532e2cbc0427dd72","observation_id":"b98d7279-ee7e-410b-b6eb-7c56223f2ad9","resolution":{"observed_at":"2026-08-06T16:15:15.821727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.824494Z","title":"Proceedings of the 35th International Conference on Neural Information Pro- cessing Systems, 15621–15634","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.824494Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:0e89cba9d9e4b45b2bf4fbdeeb818d0f2d7271356c82f7242e118f69d215ff57","observation_id":"8c46f309-995d-4c84-9d8d-ee287d1eb483","resolution":{"observed_at":"2026-08-06T16:15:15.824494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:15.827171Z","title":"The Annals of Math- ematical Statistics 400–407","venue":null,"work_id":null,"year":1951},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.827171Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:d04be767637f9024c336fd2353a6adf63910d2086f012705f857f58d0dea93e2","observation_id":"a6617798-7f47-455d-882a-528aaa128892","resolution":{"observed_at":"2026-08-06T16:15:15.827171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:16.864231Z","title":"The Thirty-eighth Annual Conference on Neural Information Processing Systems","venue":null,"work_id":"fb5412aa-72cb-490c-bd26-3b7513ba644e","year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.830079Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:7db930356dd138384df7a2cb4cb3d882595f62c108875f5287a7adbea20febd8","observation_id":"011c3f51-53b2-446a-ac6a-2aad727abf49","resolution":{"observed_at":"2026-08-06T16:15:16.867130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:16.855699Z","title":"The Thirty Seventh Annual Conference on Learning Theory , 4511–4547 (PMLR)","venue":null,"work_id":"025c62be-4ff4-4c0a-8341-476dde471a1d","year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.832787Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:ada537ff15b2553bd7b68e75b495f024b0340aa27d0211b8b9ca5c1373e34c23","observation_id":"c2a0dbfe-341e-4840-8cde-895f6b06e181","resolution":{"observed_at":"2026-08-06T16:15:16.858474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:16.847094Z","title":null,"venue":null,"work_id":"48f00741-ed01-4942-aa5e-627fcf1ca376","year":2020},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.835923Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:842cf39e69527728bc471d4615a479f5f5c456f34fdff0877413c7b7230a1879","observation_id":"71c57e02-a541-4377-b28d-d307580ff2a6","resolution":{"observed_at":"2026-08-06T16:15:16.850078Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:16.838757Z","title":"Journal of Machine Learning Research 25(200):1–91","venue":null,"work_id":"dae3be45-d39d-4faa-9b0e-14a5c99bb7ae","year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.839243Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:b078f8adf0f93124c3359ddc005ee7dd0cd62bb8ccb89eef5f47e10f507c4531","observation_id":"d4ed827c-e1e5-4db4-8080-34e1ab6f1ca1","resolution":{"observed_at":"2026-08-06T16:15:16.841650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:16.829966Z","title":"International Conference on Machine Learning (PMLR)","venue":null,"work_id":"7e56b0d3-1a45-48e8-9c8f-5eb895ea1ff2","year":2025},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.842026Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:f3126e0ad1c3c0d8e508b9e9a5b74b3cf67555cf7cd964e9f62dd719de56f421","observation_id":"9af1ae1b-f334-4b7a-99f9-71de1e318321","resolution":{"observed_at":"2026-08-06T16:15:16.832857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:16.821559Z","title":"International Conference on Machine Learning 19967–20025","venue":null,"work_id":"659520e3-0989-425a-950d-2705a1b464ca","year":2022},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.844965Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:0bae5a171f0e0ad0db5c55a92eb0358bb5057e308aa67d55e0120e5663413869","observation_id":"3af75634-3043-425f-a06d-6d45a12613eb","resolution":{"observed_at":"2026-08-06T16:15:16.824681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:16.812829Z","title":"Advances in Neural Information Processing Systems 36","venue":null,"work_id":"c60d4937-4acc-4cc0-ae6a-89eeaed30e28","year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.848230Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:4abfceb52caf23a06cc464bda0c985b605ba3e3a40284bffca44f2de68e2146c","observation_id":"0755f1ff-6864-4c27-8071-4821c2eb2d8e","resolution":{"observed_at":"2026-08-06T16:15:16.815809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:15:16.803793Z","title":"International Confer- ence on Machine Learning , 44909–44959 (PMLR)","venue":null,"work_id":"fbf4e022-096d-44b0-a925-47650e949690","year":2024},"citing_paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-06T16:15:15.850895Z"},"links":{"citing_paper":"/paper/2507.14444"},"observation_digest":"sha256:553261d3ab5ea5c013c32ed9cc471ce9c23809d6f01c6623b34b33694b273b92","observation_id":"5f5a39a2-8ae0-45d6-8cd3-5aaf5ba905ff","resolution":{"observed_at":"2026-08-06T16:15:16.807059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.14444","last_updated":"2025-07-19T02:42:41Z","latest_version":1,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-06T15:53:50.693798Z","submitted_at":"2025-07-19T02:42:41Z","title":"Statistical and Algorithmic Foundations of Reinforcement Learning"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":89,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":162},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 100 of 162 outbound references and 1 inbound Pith citation observation for arXiv:2507.14444."}