{"as_of":"2026-08-04T09:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ae30b8bc26cba80df6d1e5fe4a9e007095fd819fbcf2bfd572e02ed5773f65de","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-07T09:19:03.944541Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T11:22:20.692590Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T05:29:35.442696Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"cited_work":{"arxiv_id":"2604.27372","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.27372","snapshot_observed_at":"2026-07-04T05:29:35.442696Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","venue":"math.OC","work_id":"6409ecb5-1c75-4e8c-8420-9214bdf25835","year":2026},"citing_paper":{"arxiv_id":"2606.20356","last_updated":"2026-06-18T15:20:00Z","snapshot_observed_at":"2026-07-06T23:55:29.991442Z","submitted_at":"2026-06-18T15:20:00Z","title":"Robust $Q$-learning for mean-field control under Wasserstein uncertainty in common noise","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-26T15:59:25.061726Z"},"links":{"cited_paper":"/paper/2604.27372","citing_paper":"/paper/2606.20356"},"observation_digest":"sha256:f9d40593d9f51ce420faad49f8ce60de2af06771a6d45ebca690c563e7e2ad2b","observation_id":"d93db379-b1b8-4841-b7d6-d15a83d4d4ed","resolution":{"observed_at":"2026-07-04T05:29:35.444178Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.27372","snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-02T12:11:20.451607Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"cited_paper":"/paper/2604.27372","citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:a49fabbc147b03290baeb3175b362834db0649ae456286c653e5584f02b451a5","observation_id":"0d636a37-c4e2-4b31-bb78-42f6375f2cf1","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.27372","snapshot_observed_at":"2026-08-01T11:22:20.692590Z","title":"Continuous-time q- learning for mean-field control with common noise, part I: Theoretical foundations","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19928","last_updated":"2026-07-22T09:00:00Z","snapshot_observed_at":"2026-08-01T11:22:18.704996Z","submitted_at":"2026-07-22T09:00:00Z","title":"Continuous-Time Reinforcement Learning for $N$-Player Stochastic Differential Games with Exploratory Policies","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T11:22:20.692590Z"},"links":{"cited_paper":"/paper/2604.27372","citing_paper":"/paper/2607.19928"},"observation_digest":"sha256:fbd148b35b61ad496ef2416f5cc5b2470a18e1af8bcb97b492aea55b3a4c5021","observation_id":"da386cc4-6a4a-4eb1-b4eb-0910641b873c","resolution":{"observed_at":"2026-08-01T11:22:20.692590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.27372/citation-record","integrity":"/paper/2604.27372/integrity","json":"/paper/2604.27372/citation-record.json","paper":"/paper/2604.27372"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.07778","last_updated":"2024-10-10T10:09:44Z","snapshot_observed_at":"2026-07-06T19:31:05.226753Z","submitted_at":"2024-10-10T10:09:44Z","title":"On the grid-sampling limit SDE","version":1},"cited_work":{"arxiv_id":"2410.07778","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07778","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bender and N","venue":null,"work_id":"7fac7fd8-3233-437a-8f77-d0574a24fb6e","year":2024},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"cited_paper":"/paper/2410.07778","citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:922a1e2947892d8523dac845ea3a4f0125c24cb1104e28a81249aa1fdb306c07","observation_id":"d1eb5527-5c50-4e7d-866d-6a84b8dd79cc","resolution":{"observed_at":"2026-05-12T09:46:27.385717Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"85d27f01-e90b-4954-b4eb-81e82bde9bb4","year":2025},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:f6c30a636c12c2d1965c38777af2419457da95ca4532ac2e540788e472252a1d","observation_id":"88f3cba1-8f3f-42df-9cad-09b25a67c2aa","resolution":{"observed_at":"2026-05-27T08:28:49.030296Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Buckdahn, J","venue":null,"work_id":"ec7a5f5f-c60c-46e7-93f5-7c12d453fa23","year":null},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:91c709c765acfe8aed9e936c0aa17038b76de525936b315049be74b72244f5c2","observation_id":"63b09dca-b172-4c2c-a0ce-7c486a825d00","resolution":{"observed_at":"2026-05-27T08:28:49.021962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Buckdahn, Y","venue":null,"work_id":"6a1de687-5ea5-4489-8f77-5ffb56be98a1","year":2021},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:4016aeb85fde7dc7acd2fbe681b5d4ffc1de232eb998ce34a164b4c96b3261f2","observation_id":"e10a2ee4-c870-4c16-9815-ea37ed1ac15b","resolution":{"observed_at":"2026-05-27T08:28:49.076510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Carmona, F","venue":null,"work_id":"a26cf2b6-70db-43ba-9194-c3fe1aa964fb","year":2013},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:99df754767765944b2ea93ebff834140e940505a02cd39b81dff235f93ddd8fa","observation_id":"f857bfc0-bbb2-4203-813d-5bbd212831c6","resolution":{"observed_at":"2026-05-27T08:28:48.945974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Carmona and F","venue":null,"work_id":"9e50beda-639b-44bd-bf8f-f3a24f2d5e5c","year":null},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:1ec79a9e44c464534bc63b4d4ed5a87e2fd614e3ddb9c4e61120ed246c597f17","observation_id":"9e8a0039-bda6-4128-ab35-7a9d08e32745","resolution":{"observed_at":"2026-05-27T08:28:49.070934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Carmona and F","venue":null,"work_id":"14967581-3f15-420a-a2e5-aa50d2a4319c","year":null},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:4b447ed98929f582b62387a1bb2cc22ee228be0ae905f81029b6e7f3f6a6e6e9","observation_id":"2a72c27d-a0b2-4c3f-b87f-d6ab5a623b4c","resolution":{"observed_at":"2026-05-27T08:28:49.036603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.21793","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T19:08:49.409209Z","title":"Carmona and M","venue":null,"work_id":"966f4565-35bb-4c51-baf4-8955062de086","year":2025},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:fe04d7595ce4392317e766e468b8700f68b1e14bf982510667c8679c5bbeb8f1","observation_id":"72785a1b-7f8e-4b6e-8e21-c0b7ec29126b","resolution":{"observed_at":"2026-05-12T09:46:27.389957Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Carmona, M","venue":null,"work_id":"f985b165-41a9-447b-98c2-f85ca6affd7e","year":2023},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:ecb6bd1af2a4febcc35377916b53497181a227f0180a6f71a07eb722d31f4145","observation_id":"7cdb35e0-1cdd-40b2-9147-018cdc7d6c49","resolution":{"observed_at":"2026-05-27T08:28:48.980055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chassagneux, D","venue":null,"work_id":"6d131dd2-3087-4559-99ff-dd8dd5d55d73","year":2022},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:605b0a89495bceafeedc8702041cf30ec8856e693eac1e42006600d28389f50a","observation_id":"d0ab66cd-5c21-4602-8c77-3d49503c763d","resolution":{"observed_at":"2026-05-27T08:28:48.983360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.14446","last_updated":"2023-10-22T23:09:47Z","snapshot_observed_at":"2026-07-06T16:36:51.110530Z","submitted_at":"2023-10-22T23:09:47Z","title":"A Viscosity Solution Theory of Stochastic Hamilton-Jacobi-Bellman equations in the Wasserstein Space","version":1},"cited_work":{"arxiv_id":"2310.14446","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.14446","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cheung, J","venue":null,"work_id":"1f813c86-7338-4c2d-b482-ea6dce2c0647","year":2023},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"cited_paper":"/paper/2310.14446","citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:bdf90652a1e9b64d01734656d30559ae5ba91b6c436b974ea76d7fafd1991d52","observation_id":"2caa3d56-4bef-4ba3-8ba8-c1637a877076","resolution":{"observed_at":"2026-05-12T09:46:27.394339Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Conforti, A","venue":null,"work_id":"7e53ec3d-1f52-4ab7-a1d8-9a3acf05e42d","year":2023},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:01176e5c7f4c42c160515c1e85773ae5e3ff8700b0a3bd6f2805bb127acf73d0","observation_id":"92ef9e12-9cfd-4d85-9a25-f33ae1c6b5e1","resolution":{"observed_at":"2026-05-27T08:28:49.033469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Crisan and E","venue":null,"work_id":"e1506448-e004-4705-92d6-9db44a773761","year":2018},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:2ce472275bd2192a91838e2aacdc01bcce334f1b94d7467ca1011ea6851948fa","observation_id":"6aeae897-ab2b-431e-92c3-08046eabc89f","resolution":{"observed_at":"2026-05-27T08:28:49.039433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ad2e9e6b-d060-4715-9f33-7d350e644d23","year":2023},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:75f85417c39c7237556d34704d599c8f279fa5ce69eec5cf8158a28351917dd1","observation_id":"0ebc6a11-14b5-4192-b8ab-96965ca8ae42","resolution":{"observed_at":"2026-05-27T08:28:49.051232Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2312.11797","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T08:19:43.739663Z","title":"arXiv preprint arXiv:2312.11797 , year=","venue":null,"work_id":"ba24d661-7519-4a00-872d-bc697daaa399","year":2023},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:a3f08d4ac54f962e5c86425768395b01a60f9f229c940b75f5afb5f96b8316ab","observation_id":"0cf7e546-4f40-4533-abc7-c4a426421a36","resolution":{"observed_at":"2026-05-12T09:46:27.380686Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"dd039dc1-444b-40bd-a611-1a82cf401457","year":2022},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:ded9cb8f79b2369c918c9fada324058e8fc054d6d4b4bf5ac0a550a7f2d2241e","observation_id":"dfb8f84d-c574-435d-b004-1d28a819e740","resolution":{"observed_at":"2026-05-27T08:28:48.999707Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dong (2024): Randomized optimal stopping problem in continuous time and reinforcement learning algorithm","venue":null,"work_id":"16f79ab6-8e3c-44c8-9333-d71566b1776c","year":2024},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:b4481eaccf56b337d2f3f27680203146f93aa95c990588d9a9f24a3df2956cc6","observation_id":"6aa219e0-e212-4f87-b586-b390bb258e77","resolution":{"observed_at":"2026-05-27T08:28:48.967026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dupuis, R","venue":null,"work_id":"e707ec63-6895-4091-b66e-24b73309a942","year":2011},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:35d8c5e3825a21734a391eac75a42cd18005c649b56d3eba6a76918d92900e45","observation_id":"6e0825c9-3d74-4d73-a096-0947a67e75d8","resolution":{"observed_at":"2026-05-27T08:28:49.006988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kallenberg(2002): Foundations of Modern Probability","venue":null,"work_id":"30865a29-5d20-4266-a3fe-0a7492f6c785","year":2002},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:143b53cc90dbcc2b46437f91cf2f10d3c3947457ae86b91053d723655136f046","observation_id":"670aff43-f37b-435d-b202-2b0038fb554a","resolution":{"observed_at":"2026-05-27T08:28:49.068043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lacker (2015): Mean field games via controlled martingale problems: existence of Markovian equilibria","venue":null,"work_id":"dd210b8c-34d5-448c-b32c-bb604b24471b","year":2015},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:029b3f377a389d113e8d7e28afada4e37bde8083d277fe0542be8bbe7c9ab183","observation_id":"8fb691dd-a05b-4f71-8958-ebc7d70a627a","resolution":{"observed_at":"2026-05-27T08:28:49.058251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Frikha, M","venue":null,"work_id":"fc0ca6e5-4d77-401e-a873-4a9b45ad7dd9","year":2023},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:53c65ebfc0d62808785298cccad93a8c9fe24ec01e79784636bc4f27f7a455c7","observation_id":"ff7d78ee-d0ff-4af2-b76b-bbf94cda8b75","resolution":{"observed_at":"2026-05-27T08:28:48.941951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Graber(2016): Linear quadratic mean field type control and mean field games with common noise, with applications to production of an exhaustible resource","venue":null,"work_id":"4473a553-b23c-4042-a232-12867fb3c958","year":2016},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:ce64dc8b7de4d7b79082d57a9947bb9928aa38cce70677159f55451d92b07b18","observation_id":"2dbc0a68-d137-4978-bc1b-5bc0f9ebc145","resolution":{"observed_at":"2026-05-27T08:28:49.054145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"51ab1a49-82e7-4744-9621-7e9e295aea58","year":2021},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:c91fcc79045c856c4bc0c75931d2d724e082d1e222d757271244537f80ad577c","observation_id":"b4aff4c4-a54b-459e-b8b9-c8027e80eb30","resolution":{"observed_at":"2026-05-27T08:28:48.996619Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c06972c4-b1c6-4362-8f93-cddfc656129c","year":2023},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:5cd3504feb1503128826faaf99ac2311bd42bcc63242a87acd6a63fdcd0235d8","observation_id":"36faa87a-53f6-48db-b203-497eaa76eeac","resolution":{"observed_at":"2026-05-27T08:28:49.044995Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"481b039f-9965-4354-ad83-98f34a876482","year":2022},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:7e9a463c1b6b4f8e28e81af262c78635d8703ff61a553bdae959d86d6f9513b9","observation_id":"e517a04e-d7a0-423c-bbe2-bab77056c999","resolution":{"observed_at":"2026-05-27T08:28:48.951219Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3ccfc482-6300-4cf5-a748-b1557700c3d2","year":2023},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:bc5d0bb5e38391ec41b6df0d3b97cbe3c300c4d01e03e9aa2bf69eff557a9301","observation_id":"96676480-35a9-49c3-ba6f-e25ef826e40d","resolution":{"observed_at":"2026-05-27T08:28:48.959406Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Huang, R.P","venue":null,"work_id":"e192ccd6-9f29-4740-a48e-728cee04105d","year":2006},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:565c4b786ccf7d204c7eaf2803713f0ca78a5344d0c42563990d0afec3de6414","observation_id":"850a6bf9-abb2-44a2-9279-28c87ea096c3","resolution":{"observed_at":"2026-05-27T08:28:49.083047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.04697","last_updated":"2026-07-30T02:52:31Z","snapshot_observed_at":"2026-08-04T05:13:21.103778Z","submitted_at":"2025-12-04T11:48:07Z","title":"Continuous-time reinforcement learning for optimal switching over multiple regimes","version":3},"cited_work":{"arxiv_id":"2512.04697","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.04697","snapshot_observed_at":"2026-07-31T02:03:07.292107Z","title":"Continuous-time reinforcement learning for optimal switching over multiple regimes.Preprint, available at","venue":null,"work_id":"367d1272-f931-439d-a26c-30edc6805e32","year":2025},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"cited_paper":"/paper/2512.04697","citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:209e0f6f5f23909d4a01be7f35828a8fa4bc2dc02d1b9ac05176d898c4321df8","observation_id":"d5669ebd-2afc-4457-9c87-c6009bffcb29","resolution":{"observed_at":"2026-07-31T02:03:07.292107Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jia and X","venue":null,"work_id":"125871b9-6e74-4630-b441-36ae78caf844","year":null},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:0de2284de7580203953adf1e2315ead533b249c5b43c6e3f4608de2807fbc445","observation_id":"f43f3d44-29ff-4b74-996b-0e4d188b441b","resolution":{"observed_at":"2026-05-27T08:28:48.993686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jia and X","venue":null,"work_id":"4b33a499-bec2-402b-9576-c18df329d4d7","year":null},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:e695a0b758ef6677d968c9aea8c4ec5e7ad106b66b56f56b0aaad1fcba2a1c4b","observation_id":"56b4c1a1-e523-4c14-b28b-6f706cc5ecbb","resolution":{"observed_at":"2026-05-27T08:28:48.986696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jia and X","venue":null,"work_id":"af7c784b-972b-478c-b5b7-53eb67b03921","year":2023},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:122d61ea7fc6641327ad71df1bc38db88deb6e910313feacd1403063e3ef8e1e","observation_id":"fcd3aa95-971f-4585-bcfe-40f764e73d06","resolution":{"observed_at":"2026-05-27T08:28:49.027362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c5f838f9-ade4-4e85-bd24-cc66b01be760","year":2025},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:b421302a3659a9ab876a6df538d96de9ac426b2d4f11a6a92b9b9f68a8daf08a","observation_id":"755b94c7-2768-46ac-a3c2-e87d51ad1369","resolution":{"observed_at":"2026-05-27T08:28:49.013164Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jia (2026): Continuous-time risk-sensitive reinforcement learning via quadratic variation penalty","venue":null,"work_id":"2f888b85-cbad-46cb-9f92-a3c755321bae","year":2026},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:9759309961868c6e1580003913a479eb3425f743765b9935dc5a4c8aa498d826","observation_id":"a149f655-7e4f-4feb-b499-44e5217ab10a","resolution":{"observed_at":"2026-05-27T08:28:49.003574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"115c68bf-ca6e-4ecc-97f9-40490f737c8d","year":2007},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:0bf8f6f6f178416f6c49b41540eb6b4b343483c01fb79d5addb84e2392a59c50","observation_id":"674f7759-c29f-48f9-aaa6-6baab3156393","resolution":{"observed_at":"2026-05-27T08:28:48.971729Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Liang, Z","venue":null,"work_id":"b29cdc27-5af9-4fc9-a0fe-0e087709945b","year":2024},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:5d5b425ded52214313bec4500d832d1715ef3636a2fa13b9e8f5475534137e62","observation_id":"a9da5a6f-84b5-40ab-9dac-083529fe4466","resolution":{"observed_at":"2026-05-27T08:28:49.064797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"91bb6816-3cde-46c5-98b9-01b2e2f9a83e","year":2006},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:66a00738ccff324bf0bb9332729e38e93497cd6b2a955656664ed18296ab18c9","observation_id":"c2c2eb56-91c6-4fd2-b432-dcbc6abe3be4","resolution":{"observed_at":"2026-05-27T08:28:49.079375Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"04d548d0-2a11-450a-a176-96501dca5a51","year":1997},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:a0faf077efc90965515007247f9a5ed81780c91fd7e069ce605192c3dca07c9b","observation_id":"f33e07f3-c63f-4b2d-aa4e-a211927cd3a9","resolution":{"observed_at":"2026-05-27T08:28:49.019055Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Motte and H","venue":null,"work_id":"1f7a959a-11d6-45f3-9e62-78d06b623960","year":2022},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:3b72a8cc2098ae326f0b4ce00730d6fafa56b7870c8150f72ec4ee3ba1099360","observation_id":"362bd200-9ba0-4947-82d8-75d3e6439aab","resolution":{"observed_at":"2026-05-27T08:28:49.024594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2dce36ff-8076-45b7-bcd7-d0bc7bcc917d","year":2017},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:705c95c079b8c65d504d97fc496b1431375a689bf5a697e46f3ab466ca827c57","observation_id":"a95235de-567d-4819-8c8f-a2f8e1c3779c","resolution":{"observed_at":"2026-05-27T08:28:49.015994Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"00ebd2b1-2bee-487b-b03d-17efc233abe4","year":2026},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:66eb0f277ab3753b2109ce2a1d2d8fe64577c0b666583cef2f5931b47e38b42f","observation_id":"eaccb007-f362-42c4-8430-a4d56a2acd0e","resolution":{"observed_at":"2026-05-27T08:28:48.962910Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stroock and S","venue":null,"work_id":"063e3560-9cf1-4a99-b780-c94e4a71476d","year":1997},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:162e1f9206db88790f523ef4e618a40f441bf3b662f4d54e7d7dc68ab2515232","observation_id":"e5c60085-e76c-40a6-a3c6-d891c72c071e","resolution":{"observed_at":"2026-05-27T08:28:49.073803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Szpruch, T","venue":null,"work_id":"0c3aa866-09d6-4ceb-ac62-414fa8ddc283","year":2024},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:af28a7e46e8e0d33b2113eb9cf168edb7f129ad7bfc7148853182135e5cb4b76","observation_id":"2c0546f5-ff06-44d4-a366-4958722a8e4f","resolution":{"observed_at":"2026-05-27T08:28:49.061335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Villani (2009): Optimal transport: old and new","venue":null,"work_id":"f72285f6-b781-4cd1-9def-fe07fa7282a6","year":2009},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:f6378b921fdc2ddd6217310fb3adb4504a9c4d16993aac7acb6ef754113d9f15","observation_id":"c603e70f-6c9d-4a5d-92c0-a539e44cd6fe","resolution":{"observed_at":"2026-05-27T08:28:48.976759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4de299cf-61f4-4da8-9860-8065bd3161ef","year":2020},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:2e0980a451056dcc13e376a5aa0c457ff06f58de1ed36a9fc0f5e5903fc3fff1","observation_id":"8cc0bef3-7c4d-4f95-b732-3b9e8015e1bf","resolution":{"observed_at":"2026-05-27T08:28:49.042296Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gao and L","venue":null,"work_id":"0ed9ef8f-56d8-40ed-a34b-625e7c681844","year":2023},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:2974ea2ddb964c1858247d17a1d24737a3583e8aa5a1e51023f77611bf234eac","observation_id":"7ce9fdc6-2f6a-4f4d-9320-dace6008bdf5","resolution":{"observed_at":"2026-05-27T08:28:48.955798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Watkins and P","venue":null,"work_id":"29cde60d-c321-4485-a677-e69a9dc92a74","year":1992},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:f2e4d437d14386a3da7c3eb536cf140859ce0e2e7b74164180a57f251ee69330","observation_id":"7e326632-d3eb-46f1-993a-5d626e77414b","resolution":{"observed_at":"2026-05-27T08:28:49.010387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wei and X","venue":null,"work_id":"d8dc8942-843a-40be-a111-af8682e7613f","year":2025},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:8f39bdeb5db8244ade7a81688dbbf8011a15ec23a9a7d1d72c1482549ff209f8","observation_id":"5d62f8ea-44e5-4b0e-903f-c1fd536d1211","resolution":{"observed_at":"2026-05-27T08:28:49.048442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04521","last_updated":"2026-07-31T08:57:04Z","snapshot_observed_at":"2026-08-04T08:10:13.833007Z","submitted_at":"2024-07-05T14:06:59Z","title":"Unified continuous-time q-learning for mean-field game and mean-field control problems","version":3},"cited_work":{"arxiv_id":"2407.04521","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.04521","snapshot_observed_at":"2026-08-03T01:10:22.407760Z","title":"Unified continuous-time q-learning for mean-field game and mean-field control problems.ArXiv, abs/2407.04521","venue":null,"work_id":"468f7729-7686-4129-a45d-097408fb6b22","year":2024},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"cited_paper":"/paper/2407.04521","citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:51a18a0464d486cc05dcdab53523d56080bac225195918477814c71b3d9e5068","observation_id":"421db338-8c3d-4d5c-bda5-86e94e73713c","resolution":{"observed_at":"2026-08-03T01:10:22.407760Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wonham (1968): On a matrix Riccati equation of stochastic control","venue":null,"work_id":"d71e6f49-084f-4b6f-95ac-513132b9d43d","year":1968},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:9f7be8a45db647731027d05ad99d22ab55f5dc815c60399f059ee01e888c3548","observation_id":"2fb548ee-b912-47e1-998b-abea427902b0","resolution":{"observed_at":"2026-05-27T08:28:48.937839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Yong (2013): Linear-quadratic optimal control problems for mean-field stochastic differential equations","venue":null,"work_id":"15370228-acfa-4431-bafa-33b2bc46c9f7","year":2013},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:6e15c4129029bd8ea2f6cb3b4c3efecccf378e6437f0d5809a9d0a2e113bbe90","observation_id":"c2183c9b-8c76-42e2-b067-4034f7717d3f","resolution":{"observed_at":"2026-05-27T08:28:48.990707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04920","last_updated":"2025-07-22T03:36:32Z","snapshot_observed_at":"2026-07-06T17:13:33.874642Z","submitted_at":"2024-01-10T04:06:39Z","title":"Viscosity Solutions for HJB Equations on the Process Space","version":2},"cited_work":{"arxiv_id":"2401.04920","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.04920","snapshot_observed_at":"2026-07-02T08:36:48.269196Z","title":"Viscosity solutions for HJB equations on the process space: Application to mean field control with common noise","venue":null,"work_id":"b2c84bd9-cf2a-4c59-aba4-4b3a4965c701","year":2024},"citing_paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-07T09:19:03.944541Z"},"links":{"cited_paper":"/paper/2401.04920","citing_paper":"/paper/2604.27372"},"observation_digest":"sha256:630b87e89bf534cabdf32a9386e933aa8949b31bc7e33defd082a44c7f0bc729","observation_id":"d150e226-7cd0-43c6-9f86-c0506ca5b9f7","resolution":{"observed_at":"2026-05-12T09:46:27.376654Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.27372","last_updated":"2026-04-30T03:37:55Z","latest_version":1,"primary_category":"math.OC","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:37:55Z","title":"Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":7,"verified_fuzzy":30},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 3 inbound Pith citation observations for arXiv:2604.27372."}