{"as_of":"2026-08-04T11:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f044f5000dcc3305ec0a8266fa10355061bb8e1cd970fa8a672662b9ee26bb3e","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-07T08:41:31.247249Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T07:42:38.840826Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T05:29:35.391707Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"cited_work":{"arxiv_id":"2604.27378","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.27378","snapshot_observed_at":"2026-07-04T05:29:35.391707Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","venue":"math.OC","work_id":"da5d9949-444d-4e38-a4ea-277b4280781a","year":2026},"citing_paper":{"arxiv_id":"2606.20356","last_updated":"2026-06-18T15:20:00Z","snapshot_observed_at":"2026-07-06T23:55:29.991442Z","submitted_at":"2026-06-18T15:20:00Z","title":"Robust $Q$-learning for mean-field control under Wasserstein uncertainty in common noise","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-26T15:59:25.061726Z"},"links":{"cited_paper":"/paper/2604.27378","citing_paper":"/paper/2606.20356"},"observation_digest":"sha256:e46bab7cdabbba9c86dff74dbbd71c95991b5b02699e15c2f0363bcf8342bc33","observation_id":"6f28834f-d3fc-4abe-b1c3-6319079a036a","resolution":{"observed_at":"2026-07-04T05:29:35.407820Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.27378","snapshot_observed_at":"2026-07-14T07:42:38.840826Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11005","last_updated":"2026-07-13T02:10:07Z","snapshot_observed_at":"2026-08-02T12:11:20.451607Z","submitted_at":"2026-07-13T02:10:07Z","title":"Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-14T07:42:38.840826Z"},"links":{"cited_paper":"/paper/2604.27378","citing_paper":"/paper/2607.11005"},"observation_digest":"sha256:f0be6d70b9a4ae3b6d58a76f9e5e1d39f1be505a45cc723042d0370f99659ff4","observation_id":"3a4d0c93-e8b0-4a88-91fa-cce5ffa2ac22","resolution":{"observed_at":"2026-07-14T07:42:38.840826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.27378/citation-record","integrity":"/paper/2604.27378/integrity","json":"/paper/2604.27378/citation-record.json","paper":"/paper/2604.27378"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ambrosio, N","venue":null,"work_id":"47a753a9-7bac-4601-a1fc-59f73c3bd203","year":2005},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:1b6629c28d5ba9c64bdebd27494bbdbe1aaecdcd8d3c14c2ca01448b46fdfb0a","observation_id":"6fd4fa7a-784b-4257-8ebb-bf37f32b757e","resolution":{"observed_at":"2026-05-27T08:49:00.507078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.12151","last_updated":"2022-11-10T18:53:59Z","snapshot_observed_at":"2026-07-06T09:07:40.397451Z","submitted_at":"2020-03-24T12:50:48Z","title":"Q-Learning in Regularized Mean-field Games","version":3},"cited_work":{"arxiv_id":"2003.12151","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2003.12151","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Anahtarci, C","venue":null,"work_id":"acd47e9c-1af6-4a78-bc64-cbf7e25eca45","year":2022},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"cited_paper":"/paper/2003.12151","citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:4a402179af5fc47042ced10d4e52e5d38d7af212329ea48a5cc5ad9da22555f0","observation_id":"18fba9be-6349-466b-b7f0-af0ea18010f0","resolution":{"observed_at":"2026-05-12T09:56:27.915770Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Angiuli, J","venue":null,"work_id":"e807aea0-1694-44f2-9e76-5b4ffaede4ee","year":2022},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:ffaf9dd7ae0021cd9be78cf74f81b1533b965f0467bdd863ded9dd789a3ef6b7","observation_id":"00918088-82e0-4570-a40d-64a0bd3f4db5","resolution":{"observed_at":"2026-05-27T08:49:00.504298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10953","last_updated":"2025-03-06T05:34:00Z","snapshot_observed_at":"2026-08-03T12:35:05.263464Z","submitted_at":"2023-09-19T22:37:47Z","title":"Deep Reinforcement Learning for Infinite Horizon Mean Field Problems in Continuous Spaces","version":3},"cited_work":{"arxiv_id":"2309.10953","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.10953","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Angiuli, J","venue":null,"work_id":"9088919a-f4fe-4603-8bc2-50facadc467a","year":null},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"cited_paper":"/paper/2309.10953","citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:c98d965a3e490dcea4d3891f5b76eb8d7bb4e671f347ddf1e377d51ca27f14b4","observation_id":"617b0a4c-1fa5-4357-80e5-05772dfbb70c","resolution":{"observed_at":"2026-05-12T09:56:27.899151Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06659","last_updated":"2024-05-01T11:23:58Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-11T18:59:51Z","title":"Convergence of Multi-Scale Reinforcement Q-Learning Algorithms for Mean Field Game and Control Problems","version":2},"cited_work":{"arxiv_id":"2312.06659","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.06659","snapshot_observed_at":"2026-07-03T19:08:49.418175Z","title":"Angiuli, J.P","venue":null,"work_id":"91c4e1bd-0dda-4d52-9c4f-2fba1bd13741","year":2023},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"cited_paper":"/paper/2312.06659","citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:1b7a8874795c2841d88599ba3ae027f35d176300515c9eb02845525c8a21f74f","observation_id":"77caa214-d9d2-4d7b-b3fb-2db2e206c2ba","resolution":{"observed_at":"2026-05-12T09:56:27.975267Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"85d27f01-e90b-4954-b4eb-81e82bde9bb4","year":2025},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:1a9d376f59ee1778b2ced2a4cc0383062d88562c29a3ff5dbe61f3830604df86","observation_id":"6e259bca-d5dc-44c0-864e-fbdd92b01e52","resolution":{"observed_at":"2026-05-27T08:49:00.487152Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Carmona and F","venue":null,"work_id":"9e50beda-639b-44bd-bf8f-f3a24f2d5e5c","year":null},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:744f3d8e6b91c253ed144c6aeaec24001b54b65cb742fea07a56536b97c6a7af","observation_id":"a5b619ba-80eb-453c-9f20-5391c8f0795a","resolution":{"observed_at":"2026-05-27T08:49:00.490086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Carmona and F","venue":null,"work_id":"14967581-3f15-420a-a2e5-aa50d2a4319c","year":null},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:0af670b0b05718358cd8f049fbc1e6bc526f77a6b1807a37ee5ba781c783b4a0","observation_id":"455dfa3f-3b0a-46ac-8f5a-14ee15426f19","resolution":{"observed_at":"2026-05-27T08:49:00.493502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Carmona, J","venue":null,"work_id":"f36d2a1f-0c25-4ebe-9bf3-0029e0a0086c","year":2015},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:66d2b3b093014bd833aa43df53be0dec30554cc1d61099ca67188ba999a9f425","observation_id":"c6ca25dd-ddd0-4f0a-a3ba-eb82ddf9abcc","resolution":{"observed_at":"2026-05-27T08:49:00.496589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Carmona, F","venue":null,"work_id":"608c5a6e-58df-40eb-a3b2-3a0eae84a4b6","year":2016},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:cffd9035cada075e6c4e4acd4f0d1f9519d4fe836fe1911175a094478d6bc14c","observation_id":"194604b8-f7df-43f3-a12d-85dafe5262f2","resolution":{"observed_at":"2026-05-27T08:49:00.469652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.21793","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T19:08:49.409209Z","title":"Carmona and M","venue":null,"work_id":"966f4565-35bb-4c51-baf4-8955062de086","year":2025},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:f1adf60e2e744acbba0d217535b6635e6db2a3719512b31b0a8fe6bef1c17a8d","observation_id":"ce89d044-9b9b-4ce4-8b44-0c831301a5f6","resolution":{"observed_at":"2026-05-12T09:56:27.955564Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Carmona, M","venue":null,"work_id":"bba5cead-0212-4468-84f5-022b948dddf8","year":2023},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:a0076b1738df33709b53f6073e84653f705aa5ed4e3f7feb9180bc41d2dc372a","observation_id":"18991aed-88c4-4f70-8ac1-494dab7f6a4b","resolution":{"observed_at":"2026-05-27T08:49:00.472408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chassagneux, D","venue":null,"work_id":"17467057-8fb1-4c24-9836-f502aac6ad2b","year":2022},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:c6a5d4fccc9c9162a61804008e6b89016966a6541f98161e50289fc01833cb4f","observation_id":"3adeda22-202b-4a7d-a997-5c963916840a","resolution":{"observed_at":"2026-05-27T08:49:00.467157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.14446","last_updated":"2023-10-22T23:09:47Z","snapshot_observed_at":"2026-07-06T16:36:51.110530Z","submitted_at":"2023-10-22T23:09:47Z","title":"A Viscosity Solution Theory of Stochastic Hamilton-Jacobi-Bellman equations in the Wasserstein Space","version":1},"cited_work":{"arxiv_id":"2310.14446","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.14446","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cheung, J","venue":null,"work_id":"1f813c86-7338-4c2d-b482-ea6dce2c0647","year":2023},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"cited_paper":"/paper/2310.14446","citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:762cf859e6a059e8ba82d81db641704871732e8fee23ba3eacc7ddb1ce25439e","observation_id":"d12ddc27-c43e-4aae-8fa3-c129830563e9","resolution":{"observed_at":"2026-05-12T09:56:27.904460Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Conforti, A","venue":null,"work_id":"7defdaaf-0e09-4062-8b37-3830642bb5fa","year":2023},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:854560c8b041cbc6b12973ce2df75fe8fe4a3e8b1aa3ad9bfe2b31687c364ed0","observation_id":"74a35787-ce47-4a2f-ad3e-b4e9109e3fdb","resolution":{"observed_at":"2026-05-27T08:49:00.501651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.14772","last_updated":"2022-12-20T09:45:06Z","snapshot_observed_at":"2026-07-06T10:28:31.555048Z","submitted_at":"2020-12-29T14:36:27Z","title":"Optimal control of path-dependent McKean-Vlasov SDEs in infinite dimension","version":2},"cited_work":{"arxiv_id":"2012.14772","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2012.14772","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cosso, F Gozzi, I","venue":null,"work_id":"adfed504-4ba1-4148-bb8e-10fb12519cfc","year":2020},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"cited_paper":"/paper/2012.14772","citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:30ea7a8a5bf2f7a0386990049162f22b232c4905de56cedf64ed7416f0ab59d8","observation_id":"6241c150-153d-45c7-a438-afa305d35a0b","resolution":{"observed_at":"2026-05-12T09:56:27.910582Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Crisan and E","venue":null,"work_id":"e1506448-e004-4705-92d6-9db44a773761","year":2018},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:ac141ebde50bcdfeb45ccaa70a95a6aaf6d9fc4a9463a49a5e2bddb6b1159807","observation_id":"653902d8-b95e-450e-b05f-fd1599e67975","resolution":{"observed_at":"2026-05-27T08:49:00.461348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"adb3f1df-2262-4917-b841-99d7cdb9e8d1","year":2021},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:73a1d800d85f34785b152af42ab907c3763a29f6ed093059a6fbe1e42e0fee88","observation_id":"f631f891-a8fc-41cd-bfe2-0adc2bd2392b","resolution":{"observed_at":"2026-05-27T08:49:00.464398Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ad2e9e6b-d060-4715-9f33-7d350e644d23","year":2023},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:6116ded3dced7e95c079963d4f5b6327c0e045aed61abc1a7d0c4f7b58503e07","observation_id":"e9221019-9f33-4137-b55b-8c676915f71e","resolution":{"observed_at":"2026-05-27T08:49:00.475220Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2312.11797","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T08:19:43.739663Z","title":"arXiv preprint arXiv:2312.11797 , year=","venue":null,"work_id":"ba24d661-7519-4a00-872d-bc697daaa399","year":2023},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:eb879511d2224c9cff8817552c73cd23c1c1b115dac415b90a6852f98355a1c7","observation_id":"210d4583-2cd0-448f-9d4f-151c6a4d6561","resolution":{"observed_at":"2026-05-12T09:56:27.939953Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Djete, D","venue":null,"work_id":"d3340a33-7bbc-4a8b-908a-0a9aa81995d2","year":2022},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:f41bebac148f32bfe0cda5f7349e6741937a7c09ccc499abbeb88531ba105041","observation_id":"f31c65c6-c46c-489a-9f29-314d671e1edd","resolution":{"observed_at":"2026-05-27T08:49:00.484256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dong (2024): Randomized optimal stopping problem in continuous time and reinforcement learning algorithm","venue":null,"work_id":"16f79ab6-8e3c-44c8-9333-d71566b1776c","year":2024},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:f86e4111c46ae16f45188d0086ebbeb4943f74eb5d2dd71c1064d748f81da8e6","observation_id":"3334f914-b3ee-47e5-a83b-233227ef7603","resolution":{"observed_at":"2026-05-27T08:49:00.453449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Djete, D","venue":null,"work_id":"e7e92e1a-15c0-4319-8570-a959f00d79ee","year":2022},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:205722e38bae0d59ff0d6c63a228579de2f05f998ed79e7766f1208a2577b5e1","observation_id":"5519ca4c-fc4b-4c66-b87f-5eeca044af28","resolution":{"observed_at":"2026-05-27T08:49:00.458847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dupuis, R","venue":null,"work_id":"e707ec63-6895-4091-b66e-24b73309a942","year":2011},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:664b433dc6013c1a777f33a1ec6b132ad10dbca316792275b97a12236476b19a","observation_id":"85500359-27cf-485e-af8a-4fcf93372542","resolution":{"observed_at":"2026-05-27T08:49:00.450330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6d9a9ed1-1dd5-4e85-8643-5459ecfb931e","year":2016},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:8e025fdb99282345e181e8bbc7109f2c425d744abca6241ffccf0b34e8284640","observation_id":"0727156c-d34b-4fa3-ad1a-1da0dd6b9b50","resolution":{"observed_at":"2026-05-27T08:49:00.441238Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Doya (2020)","venue":null,"work_id":"9a1282cf-fc79-4f7a-9130-87d5d9c1ae69","year":2020},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:caceff0b5f002d7d70c574d57074b5fdbf9accb6b16f6024a76971b8748c8c7e","observation_id":"fb7b2a1f-d804-43fa-a97f-04de2e1064c7","resolution":{"observed_at":"2026-05-27T08:49:00.515203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Firoozi and S","venue":null,"work_id":"90bcc775-c030-461c-b98d-ba5ce5942a9a","year":2022},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:1d9d3fc2ffb9f19f3589237c01b93f3e202ecd099d053734c29145fbe79e6904","observation_id":"33352ebd-dc77-4fcf-906b-c72141662ed4","resolution":{"observed_at":"2026-05-27T08:49:00.444105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Frikha, M","venue":null,"work_id":"fc0ca6e5-4d77-401e-a873-4a9b45ad7dd9","year":2023},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:199ba37e6506172ec73d9790eca9440e00d311b1ce2168142db616c6cbe5ab47","observation_id":"2f3334cc-cb3a-4e03-a264-0ee885bc276f","resolution":{"observed_at":"2026-05-27T08:49:00.447245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02489","last_updated":"2024-08-05T14:11:51Z","snapshot_observed_at":"2026-07-06T18:56:57.369673Z","submitted_at":"2024-08-05T14:11:51Z","title":"Full error analysis of policy gradient learning algorithms for exploratory linear quadratic mean-field control problem in continuous time with common noise","version":1},"cited_work":{"arxiv_id":"2408.02489","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.02489","snapshot_observed_at":"2026-07-04T14:09:53.345401Z","title":"Frikha, H","venue":null,"work_id":"03beca42-153a-434f-8bc0-384aca361c5a","year":2024},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"cited_paper":"/paper/2408.02489","citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:08ecc677f2722cf647d16c88862df9114af80ddfd8b8b07d9176a6ca4a106f70","observation_id":"0b25da7c-95d8-442d-922b-023b715f1607","resolution":{"observed_at":"2026-05-12T09:56:27.967119Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Giegrich, C","venue":null,"work_id":"15f86f85-406e-4cbb-873e-c09d88593b0b","year":2024},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:2c043b296568659e31ae9be8f50902c8d64e17f9b3327ae5b46c645ad345a5ae","observation_id":"f23a04ce-4c39-42de-a4ec-982c9aaa991f","resolution":{"observed_at":"2026-05-27T08:49:00.456206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"51ab1a49-82e7-4744-9621-7e9e295aea58","year":2021},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:cf4e0d8254a396f1c3e65419a4b8a6e0b85e59d5d9a92ec6776945bdfb1ffbdc","observation_id":"5afb29cf-748f-4cb7-a3ea-59c5baad18c2","resolution":{"observed_at":"2026-05-27T08:49:00.478226Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5defde82-2033-4c37-96df-6fcf69d36a5e","year":2022},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:565100a7a69c32a09ddac3a8fa1782b6605919dd73472127c91c3330941bb45a","observation_id":"d3fbe909-a6de-4606-861e-3f9d467181cb","resolution":{"observed_at":"2026-05-27T08:49:00.435186Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"481b039f-9965-4354-ad83-98f34a876482","year":2022},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:ca45584e62044f84f0b8798c0c5e02e4b6557de8a034e1b29ac1707dffaff08e","observation_id":"e3e3a0a5-d8ee-4cf3-86ec-39a8ac3be30a","resolution":{"observed_at":"2026-05-27T08:49:00.432427Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3ccfc482-6300-4cf5-a748-b1557700c3d2","year":2023},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:d25f744d1f9b5903a3eb8b98f77d0a07ccd8566f1c7f8d47a5a222a5fb34c25d","observation_id":"3ea8048a-60bb-4366-ab7c-8f92ac1a4d13","resolution":{"observed_at":"2026-05-27T08:49:00.438401Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.04697","last_updated":"2026-07-30T02:52:31Z","snapshot_observed_at":"2026-08-04T05:13:21.103778Z","submitted_at":"2025-12-04T11:48:07Z","title":"Continuous-time reinforcement learning for optimal switching over multiple regimes","version":3},"cited_work":{"arxiv_id":"2512.04697","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2512.04697","snapshot_observed_at":"2026-07-31T02:03:07.292107Z","title":"Continuous-time reinforcement learning for optimal switching over multiple regimes.Preprint, available at","venue":null,"work_id":"367d1272-f931-439d-a26c-30edc6805e32","year":2025},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"cited_paper":"/paper/2512.04697","citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:a65996e6e307e556e98946cde3830873f21d26a3faea99808edd0d2fdf49c40e","observation_id":"4117b598-bf81-4f0b-96b1-8232ddb200c1","resolution":{"observed_at":"2026-07-31T02:03:07.292107Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jia and X","venue":null,"work_id":"125871b9-6e74-4630-b441-36ae78caf844","year":null},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:46f57c03e9a3b9f3026ee8b5e6413112c3263811522e2e1cc221254d69f313c1","observation_id":"135c9a6a-23dc-4107-afc8-08dd8c27c00b","resolution":{"observed_at":"2026-05-27T08:49:00.481369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jia and X","venue":null,"work_id":"4b33a499-bec2-402b-9576-c18df329d4d7","year":null},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:7612fc8ddbadb2410b091de0dbdf8c2bdbd9084003e6a179f826ad5388a13a60","observation_id":"de6f15cc-5e87-4a45-ac1c-d49dc978e12f","resolution":{"observed_at":"2026-05-27T08:49:00.499137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jia and X","venue":null,"work_id":"af7c784b-972b-478c-b5b7-53eb67b03921","year":2023},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:e40b57a6eff605da20cc2ea156ead5bb8557398f44b75b1bb416e7d0202e5311","observation_id":"7b5fb4e3-ebfa-4987-9d1b-86f8e1e600f5","resolution":{"observed_at":"2026-05-27T08:49:00.571962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jia (2026): Continuous-time risk-sensitive reinforcement learning via quadratic variation penalty","venue":null,"work_id":"2f888b85-cbad-46cb-9f92-a3c755321bae","year":2026},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:5e9e6b7cd1fe52177b246ff8aea070e0808c0231a76feaa0d5d30849c5a7553a","observation_id":"75aae826-5d3e-4a12-8383-7826c29a37cd","resolution":{"observed_at":"2026-05-27T08:49:00.566482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a9560757-a8e2-49c7-a056-87cb93379c4d","year":null},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:29bc767dbba62396c50c7f43273e5506965fc017c060800552be02936de7eaa1","observation_id":"9cb2366f-602e-4023-935e-357e470f9234","resolution":{"observed_at":"2026-05-27T08:49:00.558200Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kallenberg(2002): Foundations of Modern Probability","venue":null,"work_id":"30865a29-5d20-4266-a3fe-0a7492f6c785","year":2002},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:32bbabc837d73a2e1523ce8f81115d0d5180aaf71acddb7e2cc3ec55df11cdec","observation_id":"7998e14e-5365-42dd-8453-38800bbc0afd","resolution":{"observed_at":"2026-05-27T08:49:00.560965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7ecd4231-c9e8-47e3-ae29-daa2d0331f6e","year":2019},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:3af622322a7e0386293d6d58427ba5ad7438af218f43fba948e981aeda736f72","observation_id":"b0ebe943-095a-4702-974e-ec183573a7f1","resolution":{"observed_at":"2026-05-27T08:49:00.563712Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lacker and T","venue":null,"work_id":"7fac28f4-6f61-441e-a1f2-c0ff842ef21c","year":2018},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:dfc3780fcff2e35f56a9a2251a05e1698e2164d284dc4eb247a1a3f4a8a7a2a7","observation_id":"63524a39-12b4-465e-b17e-d1473aab0199","resolution":{"observed_at":"2026-05-27T08:49:00.569224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lasry and P.L","venue":null,"work_id":"4c50780a-750d-41d3-8315-7125c16e80ca","year":2007},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:2049e01c92baaedab7b3cd61c1d1ebf2f730f532b34979aceed05ceef7781371","observation_id":"f742a5d8-82e6-4acf-9401-eea3433589c3","resolution":{"observed_at":"2026-05-27T08:49:00.551141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12944","last_updated":"2024-07-26T18:20:46Z","snapshot_observed_at":"2026-07-06T13:13:58.646908Z","submitted_at":"2022-05-25T17:49:37Z","title":"Learning in Mean Field Games: A Survey","version":4},"cited_work":{"arxiv_id":"2205.12944","doi":"10.48550/arxiv.2205.12944","metadata_source":"pith","pith_arxiv_id":"2205.12944","snapshot_observed_at":"2026-07-10T22:27:38.554837Z","title":"Learning in mean field games: A survey","venue":"cs.LG","work_id":"fdf947d2-22e8-4386-9b6b-d271c9b875bc","year":2022},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"cited_paper":"/paper/2205.12944","citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:4b4149ace34ad09d36887de5702c5dc247cbee615640e64ab404817ceed72abc","observation_id":"1de2893c-0493-4b99-ad28-d8c28a704ee9","resolution":{"observed_at":"2026-05-12T09:56:27.947857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Liang, Z","venue":null,"work_id":"b29cdc27-5af9-4fc9-a0fe-0e087709945b","year":2024},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:de40f0d85259ec17ed35616d2e050046787db854ae984c1d647ec90d7f33eb27","observation_id":"b8747aaa-1dfa-41e6-b75f-7b9a0210cfb2","resolution":{"observed_at":"2026-05-27T08:49:00.534454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lions (2006): Cours au coll\\` e ge de france: Th\\' e orie des jeux \\` a champ moyens","venue":null,"work_id":"6465f346-996c-4cf1-a6b3-77897264f212","year":2006},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:271dd9097eb6f98520047b41ca6e0359c9a7d0ec9071d859f85185b9107a583b","observation_id":"b0c7817d-5ec0-4d90-98cd-27e43621de98","resolution":{"observed_at":"2026-05-27T08:49:00.537835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3a09a07e-ce75-4bd9-8a5f-b2242dc817d9","year":1997},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:0619fd59a2a3b32c0455624692a4e427775be1dc4beaa4b1ecca2da90718ff3f","observation_id":"ee388102-408a-49b7-99e2-cdc3ede0ef73","resolution":{"observed_at":"2026-05-27T08:49:00.528870Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Motte and H","venue":null,"work_id":"f9446f5c-58b1-4a50-b069-35eaaf3c6a02","year":2022},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:472a0e81978b10e1b3aae14b93c80e804c6c8f8fc94ca083cde7187fea609f45","observation_id":"fe040c8f-c729-4115-ac52-abbd5f3b2eab","resolution":{"observed_at":"2026-05-27T08:49:00.525766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mondal, M","venue":null,"work_id":"d36a2f1c-4621-4ed5-adee-600209abdffa","year":2022},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:e0ab6fcb48b8748c712cc1ae6daf1d1b3ded5538f5a7f439582dafaadfdbbc22","observation_id":"dcdc3bd5-a2ab-4ee9-8614-d590f42e5d2c","resolution":{"observed_at":"2026-05-27T08:49:00.531774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.06889","last_updated":"2023-05-26T20:10:50Z","snapshot_observed_at":"2026-08-03T00:53:41.453962Z","submitted_at":"2023-01-13T18:55:58Z","title":"Mean-Field Control based Approximation of Multi-Agent Reinforcement Learning in Presence of a Non-decomposable Shared Global State","version":2},"cited_work":{"arxiv_id":"2301.06889","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2301.06889","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mondal, V","venue":null,"work_id":"1c55f463-74c9-47cf-acab-d2cdddfe365f","year":2023},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"cited_paper":"/paper/2301.06889","citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:c4779416945f1f3df212e525b0aefde5e00bb18446ce820d1aec4e79689a1e02","observation_id":"52b2e4b8-a24a-4de8-9698-051b9470f4c1","resolution":{"observed_at":"2026-05-12T09:56:27.925565Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.04050","last_updated":"2023-05-09T09:17:03Z","snapshot_observed_at":"2026-07-06T11:27:27.947651Z","submitted_at":"2021-07-08T18:01:02Z","title":"Efficient Model-Based Multi-Agent Mean-Field Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2107.04050","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.04050","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient model-based multi-agent mean- field reinforcement learning","venue":null,"work_id":"e3f5eb93-c537-42b1-9787-f04f380649a9","year":2021},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"cited_paper":"/paper/2107.04050","citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:280f87d46c592053dc30c16792623495bc9bccf85d85d3ffd6629793c6fd38cf","observation_id":"fcf30e3c-e6aa-498d-940a-d66fe3a450cc","resolution":{"observed_at":"2026-05-12T09:56:27.921031Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c709a7cb-2e29-4f1e-8a60-1ba78aff06e6","year":2017},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:b525aa8ee236c0699cdeddec74172aa24569a4838524f3771b3775477edcf1b3","observation_id":"e2ef8d98-fb88-444e-8949-6f3a50f014c5","resolution":{"observed_at":"2026-05-27T08:49:00.541495Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pham and X","venue":null,"work_id":"16d1a972-7906-42ac-9182-b97c1d9a43b9","year":2024},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:b20d9afb8a545baea98f2b7fecd3887ba22e3f2f3c27a863154099a277de8262","observation_id":"4f941bbb-5569-4e42-9690-2c756fdad3b9","resolution":{"observed_at":"2026-05-27T08:49:00.547329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pham and X","venue":null,"work_id":"6f3a027a-41ac-4e2d-9c3e-4fb5d2df7841","year":2023},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:a477845be506c3bfda117fb4187ec4ab80f225070feb4e9889e7a52627be8b10","observation_id":"d81143eb-ae52-44c3-a9fa-9bba3b5bd041","resolution":{"observed_at":"2026-05-27T08:49:00.520617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6d4c97ba-b104-4862-a3ab-9c370e451676","year":2026},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:1ab7873ed929dffe6f134ef41f4f8e63fb2eb18b5162240a6cbf3063b0e9e53a","observation_id":"4f3673fc-f1c1-466b-898b-17d7eb7df07a","resolution":{"observed_at":"2026-05-27T08:49:00.523168Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4de299cf-61f4-4da8-9860-8065bd3161ef","year":2020},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:69cfb45eb3c0e45a86b4965b0b3b2c7c1d0a301f1e22946eadca991bfd7053ce","observation_id":"7717e50b-1166-402b-b264-8fd26f8d30f1","resolution":{"observed_at":"2026-05-27T08:49:00.517830Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gao and L","venue":null,"work_id":"0ed9ef8f-56d8-40ed-a34b-625e7c681844","year":2023},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:d478b09f4331462d6d315aab6be652c6a668f221daa794678302f4d5b25c96e8","observation_id":"fa99ffa9-d6ca-4966-b63b-f1c4b6a6e085","resolution":{"observed_at":"2026-05-27T08:49:00.554381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8cfbe722-bafc-4801-b8bd-04eb95cda30f","year":1989},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:b6338680f42a4c13d26956de1da4fb2ef99390c32f7fe5608ef8a3115e5bc4f9","observation_id":"ffed49b6-2f42-4657-b533-c360afc5ab1b","resolution":{"observed_at":"2026-05-27T08:49:00.544492Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Watkins and P","venue":null,"work_id":"40832ac7-6885-43cb-a62f-cb82da26fb17","year":1992},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:8cb2e42bf6e392c0bdfd525bf4d8f61e16c1f669a284f2dd547a93792c709c39","observation_id":"1918b7d7-f3ac-4919-ada7-7c71efa2cef7","resolution":{"observed_at":"2026-05-27T08:49:00.512590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wei and X","venue":null,"work_id":"d8dc8942-843a-40be-a111-af8682e7613f","year":2025},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:278c3e2841209a1d40703ef0a44811e8bbc8c0bb599ffdef26d90d393a3def95","observation_id":"a692dbe6-2b29-415c-8da0-3c67b7c6a987","resolution":{"observed_at":"2026-05-27T08:49:00.509825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04521","last_updated":"2026-07-31T08:57:04Z","snapshot_observed_at":"2026-08-04T11:10:25.093817Z","submitted_at":"2024-07-05T14:06:59Z","title":"Unified continuous-time q-learning for mean-field game and mean-field control problems","version":3},"cited_work":{"arxiv_id":"2407.04521","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.04521","snapshot_observed_at":"2026-08-03T01:10:22.407760Z","title":"Unified continuous-time q-learning for mean-field game and mean-field control problems.ArXiv, abs/2407.04521","venue":null,"work_id":"468f7729-7686-4129-a45d-097408fb6b22","year":2024},"citing_paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-05-07T08:41:31.247249Z"},"links":{"cited_paper":"/paper/2407.04521","citing_paper":"/paper/2604.27378"},"observation_digest":"sha256:b5bb965b09efd555ce7a474b71f2eb7210e73332f3514161884150c93ce6fa09","observation_id":"af00bf24-b6b7-4ed5-8720-a9996e0f244a","resolution":{"observed_at":"2026-08-03T01:10:22.407760Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.27378","last_updated":"2026-04-30T03:41:00Z","latest_version":1,"primary_category":"math.OC","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T03:41:00Z","title":"Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":13,"verified_fuzzy":34},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 2 inbound Pith citation observations for arXiv:2604.27378."}