{"as_of":"2026-08-13T06:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ec348121a099410f9f4baa34c1828ed0da723c3f63005d736046b57af4faae44","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-24T11:25:12.822765Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T15:52:37.070457Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T05:30:53.567417Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07059","snapshot_observed_at":"2026-08-11T15:52:37.070457Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.10692","last_updated":"2024-12-14T05:35:44Z","snapshot_observed_at":"2026-08-12T05:59:08.320981Z","submitted_at":"2024-12-14T05:35:44Z","title":"Continuous-time optimal investment with portfolio constraints: a reinforcement learning approach","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-11T15:52:37.070457Z"},"links":{"cited_paper":"/paper/2209.07059","citing_paper":"/paper/2412.10692"},"observation_digest":"sha256:767f0ea10181175f6957df5b336487e10e12bd8ec811da3acf994c7efe7f38ba","observation_id":"515f29ec-a540-42de-864a-95f813e05948","resolution":{"observed_at":"2026-08-11T15:52:37.070457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"cited_work":{"arxiv_id":"2209.07059","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.07059","snapshot_observed_at":"2026-08-07T05:30:53.567417Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","venue":"math.OC","work_id":"dae07b5b-1bec-4659-b017-1d20ce1db66c","year":2022},"citing_paper":{"arxiv_id":"2506.08121","last_updated":"2026-07-13T21:00:23Z","snapshot_observed_at":"2026-08-12T05:58:47.315124Z","submitted_at":"2025-06-09T18:20:21Z","title":"Continuous Policy and Value Iteration for Stochastic Control Problems and Its Convergence","version":2},"reference_index":8510,"source":"pdf_text","source_observed_at":"2026-08-07T05:30:53.529461Z"},"links":{"cited_paper":"/paper/2209.07059","citing_paper":"/paper/2506.08121"},"observation_digest":"sha256:d294ca8a07bd9db72cbb9956f71c63672663f3e6dccf0c5db4644fef30da228a","observation_id":"d2e2057b-20b1-4630-8632-f97c71617ab8","resolution":{"observed_at":"2026-08-07T05:30:53.573835Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2209.07059/citation-record","integrity":"/paper/2209.07059/integrity","json":"/paper/2209.07059/citation-record.json","paper":"/paper/2209.07059"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Second order elliptic equations and elliptic systems, volume 174 of Trans- lations of Mathematical Monographs","venue":null,"work_id":"f1072ef2-a8cd-43ef-a864-a39edb2dd4f2","year":1998},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:a14daa235d1dd980e3e1fedf854bd27ec838209317a0bbba0d2cb9307990603c","observation_id":"c21db4c5-ae56-4c38-b755-d15e2c0a2151","resolution":{"observed_at":"2026-05-24T11:26:09.217603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning equilibrium mean-variance strategy","venue":null,"work_id":"1150f776-7019-47b4-b0fe-0a3c342fe2e6","year":2023},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:eb7e123caa8de9de19f26231f4d87a120f3df5b24e858529194500d042cd0882","observation_id":"9eb77077-ee9a-4560-ac47-0d357e567849","resolution":{"observed_at":"2026-05-24T11:26:09.153180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"83f0f5f5-e3ff-443d-9dfe-c76f4136e2fc","year":1998},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:1a1305ce82453d5d6077dfb6949cce3abff313afb47149a0bedf7ba3e86e6d77","observation_id":"d94b767f-a519-42a9-ace3-fc64780a318a","resolution":{"observed_at":"2026-05-24T11:26:09.163985Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Exploratory LQG mean field games with entropy regularization","venue":null,"work_id":"f379dcfa-0363-4706-b800-f30aeb15399a","year":2022},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:bd0d4c874d7d8b264eaef14e7d814661c0519db49a938f0e1011ddc53c44d4a6","observation_id":"394a5215-505d-431b-969b-a03390425b50","resolution":{"observed_at":"2026-05-24T11:26:09.240206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Taming the noise in reinforcement learning via soft updates","venue":null,"work_id":"c0a4596d-2510-47c5-b753-84e33d1f57f0","year":2016},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:28a34c90c89350d84a11b14effb92e7c9e4eb806b404a5b8a53a73d56289f39d","observation_id":"98050124-d32b-48e2-acad-658b994783a8","resolution":{"observed_at":"2026-05-24T11:26:09.246705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Trudinger","venue":null,"work_id":"c62db29b-aa10-41c2-b3eb-325d879747c8","year":2001},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:23a109b2467c42493752a392e75af4ea050ea218c7804599da293956980380cb","observation_id":"3c103ba0-2e30-4dfc-bf0c-e4a2d8d2ebb2","resolution":{"observed_at":"2026-05-24T11:26:09.202064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Entropy regularization for mean field games with learning","venue":null,"work_id":"dc7c018f-eceb-4ab7-a3d2-0741bf5709be","year":2022},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:6204fcc2e3dc5e4a000f994f4ea7a4424d508f7b31efdff54bff2a5db204da95","observation_id":"b0c7577d-06ce-4d79-9ff3-d08d2312b5e4","resolution":{"observed_at":"2026-05-24T11:26:09.146960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reinforcement learning with deep energy-based policies","venue":null,"work_id":"e2ec7293-c195-4f77-889c-565369bc87ca","year":2017},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:65b13dba9935c646cc90d7e05059151644b22d7909b3d97c5e193f4f29a2d445","observation_id":"2531fded-2d8f-40ba-818a-776c6ef5cdfb","resolution":{"observed_at":"2026-05-24T11:26:09.232513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","venue":null,"work_id":"98b0fa1b-ab0f-49cb-b0c9-6e534f56fa86","year":2018},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:f1e37249f48ffa2bb1db85f6424be18308333a4790ff7219ce5ec2819a32de6f","observation_id":"6d969779-70cf-402b-b603-9dc3e556422f","resolution":{"observed_at":"2026-05-24T11:26:09.224900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jacka and Aleksandar Mijatovi´ c","venue":null,"work_id":"8c611034-21f5-474a-8d7c-3d7ac1d334db","year":2017},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:7e77abdd8987da676035d199517e761b8aa0f621ea4fab42d86c5835b7caf1a6","observation_id":"7ee46a17-1f7d-4d20-8550-129021c20016","resolution":{"observed_at":"2026-05-24T11:26:09.167727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3788fad5-a3e7-45dc-aa6e-e6b7a402faab","year":1957},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:daec8bd198a00da7cad114895c893c846824ba21e720010851495fcb4c474cf4","observation_id":"df8a86c2-e2bf-4f59-a05e-b4d533172a61","resolution":{"observed_at":"2026-05-24T11:26:09.236857Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"97bd50ee-e2f5-480e-aecd-71f08a2882b7","year":1957},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:65f60cfa35bffa43226c0b501e0fc650a37e793ee096992eb2b262d3a4aeb540","observation_id":"385fdfac-bede-4493-a528-e9c26c281144","resolution":{"observed_at":"2026-05-24T11:26:09.176502Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"q-learning in continuous time","venue":null,"work_id":"7be64d7b-165a-436a-9082-630eea3ddcd8","year":2023},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:a3ed3e18ba4466e3cd9e9fcef7bbe41df1adc61504a86a560cd59860c916e05d","observation_id":"4811f6d9-e3bd-4642-8d3c-0ad973a3c75b","resolution":{"observed_at":"2026-05-24T11:26:09.232890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"719d283c-a6ab-466f-8807-626b3140f261","year":1991},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:8581e0e9b924a6247920680af66096af086e5f5f1b6556de8b6fb66293d5be3b","observation_id":"94e53293-c1d9-43b9-aaa9-d3ef331ce335","resolution":{"observed_at":"2026-05-24T11:26:09.242907Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kerimkulov, D","venue":null,"work_id":"afd3497e-baa3-49ad-b55a-54d670895729","year":2021},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:8bd03dd33be2ced72fd961d1c1585efe06d261b98ddd274b9cb39a59136d92e2","observation_id":"c105a17b-02b9-49df-96a5-eacf875b0f3c","resolution":{"observed_at":"2026-05-24T11:26:09.236215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Exponential convergence and stability of Howard’s policy improvement algorithm for controlled diffusions","venue":null,"work_id":"60c07836-6b26-4b4c-9b58-4f6555b93ecf","year":2020},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:2b4f10ac6965ef7ba902504788e6751c218849d02338f48f4dcf4ccc19b9a88c","observation_id":"abb087c2-99ac-48ff-9021-700f50d94391","resolution":{"observed_at":"2026-05-24T11:26:09.220497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Policy iterations for reinforcement learning problems in continuous time and space—fundamental theory and methods","venue":null,"work_id":"b40df3b0-5143-4fdb-9f96-0aa85e2a0e57","year":2021},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:299f5ffa83b7fd3507f7d3be999b239ebb38122f294ec18103d622382be48017","observation_id":"cf0bef36-12f0-446c-a26d-b991c1564ab5","resolution":{"observed_at":"2026-05-24T11:26:09.186718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.04682","last_updated":"2021-05-10T21:40:56Z","snapshot_observed_at":"2026-08-12T07:05:44.327167Z","submitted_at":"2021-05-10T21:40:56Z","title":"Value Iteration in Continuous Actions, States and Time","version":1},"cited_work":{"arxiv_id":"2105.04682","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2105.04682","snapshot_observed_at":"2026-07-02T02:46:29.413053Z","title":"Value iteration in continuous actions, states and time","venue":null,"work_id":"d7acbd1b-d819-4f76-aea7-ff6d83b8669c","year":2021},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"cited_paper":"/paper/2105.04682","citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:58f28778db09145a4f6664b32d6cec5c9dc974b236b680e16d83f042f04b5e63","observation_id":"184c3cd6-3214-45db-a1a2-7f4fa125436b","resolution":{"observed_at":"2026-05-24T11:26:09.005905Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Higher chain formula proved by combinatorics","venue":null,"work_id":"72dcd78b-a878-4238-a00b-0051aa5f1976","year":2009},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:b26de8dd4b2dfce484fcbf0f6f4ffe2d93e14807058800006df01f94da48a724","observation_id":"f554acd8-3220-49de-8d23-195d447c70f1","resolution":{"observed_at":"2026-05-24T11:26:09.239670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"568639b9-ecd4-4c7a-a328-6350e1265b88","year":1981},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:bc88dfd6cba1d76e541d842710c279918c0a896a5daf70cdf886533fbeb0011d","observation_id":"8144c54c-9df6-4d9c-9a4d-10050f192096","resolution":{"observed_at":"2026-05-24T11:26:09.215950Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Regularity and stability of feedback relaxed controls","venue":null,"work_id":"c7e68f01-b2e7-4951-8ffd-9a42e7353422","year":2021},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:e291def112f5eb3b29ccd471b6d5fe555c3e2f65bdf0a2639041baab978954f3","observation_id":"556a6338-a26e-4640-aa46-ebcbd6355afc","resolution":{"observed_at":"2026-05-24T11:26:09.213788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0e86e16e-5278-4cbe-8a44-7e0f0c3eddc9","year":1948},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:72948ab62e083219a788aaaaab645daea534d2374d72adef63be91cc1e27b917","observation_id":"3b8c6086-367b-4fde-b741-f5e766181509","resolution":{"observed_at":"2026-05-24T11:26:09.206427Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00419","last_updated":"2025-04-09T20:32:37Z","snapshot_observed_at":"2026-07-06T14:36:32.950556Z","submitted_at":"2023-01-01T15:07:22Z","title":"Policy iteration for the deterministic control problems -- a viscosity approach","version":2},"cited_work":{"arxiv_id":"2301.00419","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2301.00419","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Policy iteration for the deterministic control problems–a viscosity approach","venue":null,"work_id":"ee45c008-59c3-4024-b5c3-7c9363fb1d80","year":2023},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"cited_paper":"/paper/2301.00419","citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:4da8af6c8a2d1c1a5a06798c4bc75c8709b4b8597592e762b4d9b083f7dd5075","observation_id":"3c9b46e0-4dc8-42bc-96db-63ed5a8c38f4","resolution":{"observed_at":"2026-05-24T11:26:08.991619Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Exploratory hjb equations and their convergence","venue":null,"work_id":"cf963417-2963-4fd8-8014-a602940707ab","year":2022},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:0563a52745bfd80813d8944888f3f9c967b6f03dbda07d6e3a20cfe3a7172651","observation_id":"db841bae-6f80-44e9-8320-57b46e065a59","resolution":{"observed_at":"2026-05-24T11:26:09.229034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Continuous-time reinforcement learning control: A review of theoretical results, insights on performance, and needs for new designs","venue":null,"work_id":"c89a856b-e978-49fa-a2b8-45022a530985","year":2023},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:9543bbd97b6b9764e3a2d0bae26a37cfcead7d8fa574074a2766c40e4c5baea6","observation_id":"7282fa5a-4398-4db2-8cd0-e1b8769f71dd","resolution":{"observed_at":"2026-05-24T11:26:09.160372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reinforcement learning in continuous time and space: a stochastic control approach","venue":null,"work_id":"4433e4cd-b762-49ea-93f4-704ed2e3fb3e","year":2020},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:09eefc1a3cf7b4f6436889f50ef1b81727559c2e046d3144afc3d2b3e76f8dac","observation_id":"a6e86ab9-f662-4571-b749-8bf30913d064","resolution":{"observed_at":"2026-05-24T11:26:09.243588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Continuous-time mean-variance portfolio selection: a reinforcement learning framework","venue":null,"work_id":"ae9d56f7-ac48-4af9-a82c-147ba21b27cd","year":2020},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:54d32b524791e6f3c00941ea9fc82946fddd4e52723ec71b28a448b46ebb8340","observation_id":"07ab9f59-b436-4839-b75f-6bbf4dbcb1b4","resolution":{"observed_at":"2026-05-24T11:26:09.211783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ziebart, J","venue":null,"work_id":"26928b05-32ab-44fa-b6d9-a82007dfeb30","year":2010},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:9cacde65e280d00794c5f376f7581b8602a1ac4e87d56f333c868176bc64f555","observation_id":"a9de8540-d1ad-4efa-b18c-664f5e3b8aa6","resolution":{"observed_at":"2026-05-24T11:26:09.224593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ziebart, Andrew L","venue":null,"work_id":"c00708d9-e9e5-4d48-a554-3dacf1a6c6d8","year":2008},"citing_paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems","version":5},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-24T11:25:12.822765Z"},"links":{"citing_paper":"/paper/2209.07059"},"observation_digest":"sha256:3ec5b238c4a38da8a58d1eabd6bba5b2ddca2875eba476f25a6e40253b69ec08","observation_id":"9011900a-b31c-4c85-a773-828d553a3769","resolution":{"observed_at":"2026-05-24T11:26:09.207878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2209.07059","last_updated":"2024-12-19T22:30:09Z","latest_version":5,"primary_category":"math.OC","snapshot_observed_at":"2026-08-01T08:53:49.454893Z","submitted_at":"2022-09-15T05:46:35Z","title":"Convergence of Policy Iteration for Entropy-Regularized Stochastic Control Problems"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":2,"verified_fuzzy":21},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 2 inbound Pith citation observations for arXiv:2209.07059."}