{"as_of":"2026-08-08T04:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:116819b6f198374a022838d461d584321282c18fa0accf69e944fd9a5571f3a5","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:25:56.452058Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.05894/citation-record","integrity":"/paper/2506.05894/integrity","json":"/paper/2506.05894/citation-record.json","paper":"/paper/2506.05894"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.556722Z","title":"Value iteration algorithm for mean- field games","venue":null,"work_id":"60c2b300-5279-4370-a547-ace19b298db6","year":2020},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:49.554219Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:e1c4bb6c87310d9e61c7e6ccc1584a38414352176751d4c048e4d424819eb6e2","observation_id":"785a7eff-dc7e-424c-afed-7efebc62578f","resolution":{"observed_at":"2026-08-07T10:25:58.559605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.548924Z","title":"Unified reinforcement q-learning for mean field game and control problems","venue":null,"work_id":"9eff4e09-94fa-4b7d-8166-1164b666da3f","year":2022},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:49.639583Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:85e181af217d2026b23ceb3cafbfd9d9deadb890af043b409943e040812b3615","observation_id":"7db36181-eddf-4575-8802-3f5cdfca4e99","resolution":{"observed_at":"2026-08-07T10:25:58.551580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.541065Z","title":"Stochastic graphon games: II","venue":null,"work_id":"bb9059de-6c9f-4571-b087-ee47ed503f3d","year":2022},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:49.790981Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:b4138e90fcd7569d66b283393d140d41667db24e2f531579b1a02b8fddb7f510","observation_id":"efcfd009-787b-483b-b5fe-2e6069da6fb5","resolution":{"observed_at":"2026-08-07T10:25:58.543561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.532904Z","title":"Berahas, Liyuan Cao, Krzysztof Choromanski, and Katya Scheinberg","venue":null,"work_id":"546c995b-fb81-4afb-bbcf-9f09d4ba615c","year":2022},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:49.928649Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:1eb9a7293a44bad362068d5b17888eae8b6e6490b24a8bf76826e318e1c39ef8","observation_id":"a2c3fda2-815f-492e-a65d-f853df8b6ba4","resolution":{"observed_at":"2026-08-07T10:25:58.535643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.524821Z","title":"An Lp theory of sparse graph convergence i: Limits, sparse random graph models, and power law distributions","venue":null,"work_id":"4bf1475f-c6f3-40d2-b98e-2ec17432c633","year":2019},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:50.035037Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:a54c834a0ce6bcf50190e37b7c4544724ac3f5e2bfa92adc2ee179b9159a7392","observation_id":"a0e11cf2-e17c-418f-8c40-8cd5655da34e","resolution":{"observed_at":"2026-08-07T10:25:58.527738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.516780Z","title":"Chayes, Henry Cohn, and Yufei Zhao","venue":null,"work_id":"1a7d1871-dd8f-4ad4-b56c-298e92ea217f","year":2018},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:50.119793Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:6b09e9d74c34562e852b99ce258498c5a7a47060fc15772a89dc268868c298f2","observation_id":"123f7447-30c8-42d1-97e2-3bb0285ef568","resolution":{"observed_at":"2026-08-07T10:25:58.519563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.508603Z","title":"Functional Analysis, Sobolev Spaces and Partial Differential Equations","venue":null,"work_id":"b7346e6b-2d38-4011-96bd-577ffeb55aac","year":2011},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:50.175222Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:46ceae3f99064cb26451ca9a6e2ae263758ddbc7003a33ade5393825d1976ac4","observation_id":"3542a397-2415-4f04-afee-fc70ea509587","resolution":{"observed_at":"2026-08-07T10:25:58.511383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.09178","last_updated":"2020-06-12T23:23:50Z","snapshot_observed_at":"2026-08-03T18:36:39.671612Z","submitted_at":"2020-06-12T23:23:50Z","title":"Policy Gradient-based Algorithms for Continuous-time Linear Quadratic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.09178","snapshot_observed_at":"2026-08-07T10:25:50.242646Z","title":"Policy gradient-based algorithms for continuous-time linear quadratic control","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:50.242646Z"},"links":{"cited_paper":"/paper/2006.09178","citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:5608a31279a06c9826aed119155a0cfce3e3b919930b1131051d119f9bea3243","observation_id":"268cc0c8-0e71-4c4f-8d2b-eff23765fff7","resolution":{"observed_at":"2026-08-07T10:25:50.242646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.500422Z","title":"Caines and Minyi Huang","venue":null,"work_id":"edd3a408-d753-41dc-9aac-a314d0abf136","year":2021},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:50.336317Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:0ad44a052b11f6de01cad6c710cc3f62c2a7225e93c0833b3f6a7517ff40dc0c","observation_id":"7175448f-8be3-4a07-9c46-f35e44628ed0","resolution":{"observed_at":"2026-08-07T10:25:58.503030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.492404Z","title":"Financial Mathematics","venue":null,"work_id":"d36d198e-bee6-4cbf-9a03-1b65fb7a5dbb","year":2016},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:50.443526Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:28d14232b7d77b87e93301cdb0a31f65a536d5f65c87d107988c6474f89dbb6c","observation_id":"ebf7009f-a1af-48e6-a049-0a496c937c73","resolution":{"observed_at":"2026-08-07T10:25:58.495330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.484791Z","title":"Cooney, Christy V","venue":null,"work_id":"ac5ebf3f-112d-4452-9732-61877ff401b2","year":2022},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:50.539531Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:72829e06b04b251a8e1f9ed61c4e983e67110eb3237d3c7e8a427fc3b48ee849","observation_id":"07a7c107-9089-4b83-9fbb-b66acd672b52","resolution":{"observed_at":"2026-08-07T10:25:58.487337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.476489Z","title":"Deep learning for mean field games and mean field control with applications to finance","venue":null,"work_id":"2f736326-09fe-425e-9795-ef849bcc5300","year":2023},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:50.619486Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:647db64691a1d0cfb4d249e687ba05434ce0c2ee97f28ce0e6538e7e31dda765","observation_id":"e669e92f-5b9c-46d4-bd91-2aff43417c13","resolution":{"observed_at":"2026-08-07T10:25:58.479292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.04295","last_updated":"2025-04-28T23:55:02Z","snapshot_observed_at":"2026-07-06T08:28:15.985260Z","submitted_at":"2019-10-09T23:19:39Z","title":"Linear-Quadratic Mean-Field Reinforcement Learning: Convergence of Policy Gradient Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.04295","snapshot_observed_at":"2026-08-07T10:25:50.732625Z","title":"Linear-quadratic mean-field reinforce- ment learning: Convergence of policy gradient methods","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:50.732625Z"},"links":{"cited_paper":"/paper/1910.04295","citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:d368158791ec313406f2fbddf89a1c5e101b7dff6a1d2f3ce4045d87da0991a3","observation_id":"eec5f744-7b5d-4f39-9d94-85ca914afc08","resolution":{"observed_at":"2026-08-07T10:25:50.732625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.468421Z","title":"Approximately solving mean field games via entropy-regularized deep reinforcement learning","venue":null,"work_id":"817dc493-7092-4ab9-aebb-3a82f42cc0be","year":1909},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:50.868633Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:6f4c02fb561bfe708fec6879ab0de436e1b616ace0dcc244b4e6079d252ecf12","observation_id":"1004d101-8bb8-45d1-be4c-5d1933abb5e1","resolution":{"observed_at":"2026-08-07T10:25:58.471147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.460701Z","title":"Learning graphon mean field games and approximate Nash equilibria","venue":null,"work_id":"72c2c885-47ba-47f4-9b28-6622043946a0","year":2022},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:51.023614Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:f76f057354dbe1828e6ac0d433ec31040a2b0b96ad4e602940defe885680bbcb","observation_id":"78277913-cbb5-471b-b07c-d73702318517","resolution":{"observed_at":"2026-08-07T10:25:58.463392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.452309Z","title":"Dechevski and Lars Erik Persson","venue":null,"work_id":"08e1956e-010d-4029-aebd-ffef17e488a3","year":1994},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:51.198586Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:78bfdf6bfc9e4f3af7d9221b7e78ba703cf26763efb758ab4d17e12f4fbdc8fa","observation_id":"d9107452-ab73-4e50-975e-d078c9c77215","resolution":{"observed_at":"2026-08-07T10:25:58.455466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.443790Z","title":"On the convergence of model free learning in mean field games","venue":null,"work_id":"8d633c43-3b37-469b-9bd7-f11cba8ea1c7","year":2020},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:51.317948Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:51a9715fb62bb98353652ba039ea0d436ff6f1e13ea0d81dbd49b17c1d490489","observation_id":"11d9b855-377c-420a-828b-ad632b70dc71","resolution":{"observed_at":"2026-08-07T10:25:58.446518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.435272Z","title":"Learning sparse graphon mean field games","venue":null,"work_id":"a9828e02-96e3-4bff-b2d2-622ee2a7a756","year":null},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:51.437786Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:3a68c3d4a933bf16cb361e86ffd31ee67fc64ebd73bee1e38cd941a0424089fc","observation_id":"50967019-6c8a-4d3c-b346-641383314127","resolution":{"observed_at":"2026-08-07T10:25:58.438140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.426920Z","title":"Global convergence of policy gradient methods for the linear quadratic regulator","venue":null,"work_id":"e84760b8-9cb8-418a-9c43-9693c0ccda16","year":2018},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:51.590918Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:bf00cce61de8c29f9dcb46a0ba3973b67a053c909e4da4854b6b75fb208761c4","observation_id":"5b96362f-5e25-461f-9226-f9eaae412486","resolution":{"observed_at":"2026-08-07T10:25:58.430093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02489","last_updated":"2024-08-05T14:11:51Z","snapshot_observed_at":"2026-08-06T15:55:12.024773Z","submitted_at":"2024-08-05T14:11:51Z","title":"Full error analysis of policy gradient learning algorithms for exploratory linear quadratic mean-field control problem in continuous time with common noise","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02489","snapshot_observed_at":"2026-08-07T10:25:51.664862Z","title":"Full error analysis of policy gradient learning algorithms for exploratory linear quadratic mean-field control problem in continuous time with common noise","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:51.664862Z"},"links":{"cited_paper":"/paper/2408.02489","citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:6d7df6404cd89460bf2cd2facedaddcbd66dee1db59c1d1e817a6027b6f3a958","observation_id":"3f191497-aaaa-4169-b700-ae468df838aa","resolution":{"observed_at":"2026-08-07T10:25:51.664862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.419186Z","title":"Caines, and Minyi Huang","venue":null,"work_id":"3bc58fa4-13de-42ee-b961-1cac84d08557","year":2023},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:51.764041Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:8e04863ee1725d5876265ddf84e5c992901cb2d3f874c41a388d77767cbfb773","observation_id":"ed498024-705a-41c7-9624-ad7968ee1dc1","resolution":{"observed_at":"2026-08-07T10:25:58.421695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.411118Z","title":null,"venue":null,"work_id":"913d5724-4b21-4ec1-b4a8-edd4f77109d6","year":2021},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:51.831285Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:b94d0f6233ffd1802a8155617dce6ebed040d4fd0913fe78791b48fd0ccbcf8f","observation_id":"6e630b54-f70a-4e26-bdb3-8a924e38c07d","resolution":{"observed_at":"2026-08-07T10:25:58.413846Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.402686Z","title":"Convergence of policy gradient methods for finite-horizon exploratory linear-quadratic control problems","venue":null,"work_id":"73c5c5ec-a3d4-42eb-967c-60ac9dfd1c14","year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:51.925261Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:0b6092151e7fbf173cf38e54b06ff9b41d8cb51dfed886c1b7831d934f093ce8","observation_id":"e710deb9-6db8-4643-b121-a361319ae50d","resolution":{"observed_at":"2026-08-07T10:25:58.405448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.394788Z","title":"Volterra Integral and Functional Equations","venue":null,"work_id":"c1c43dca-0fab-42a8-84ad-2a5adefc53a3","year":1990},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:52.040532Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:813050c296d2c15c6cb0377cf98c498fbd9892c79673e07254e59aab8c7f2c5a","observation_id":"4428bf96-8c76-4a93-b366-ee0bc5c299ba","resolution":{"observed_at":"2026-08-07T10:25:58.397411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.386847Z","title":"Learning mean-field games","venue":null,"work_id":"4519ebcf-a493-4376-ae86-314e11abb66b","year":2019},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:52.121901Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:9502aa5c052ba9658c5539252de9a51dcdd0ed02fc790063e5be63b884429531","observation_id":"d7e87767-315b-4220-ae25-0eb85ec081a4","resolution":{"observed_at":"2026-08-07T10:25:58.389457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.378400Z","title":"Policy gradient methods for the noisy lin- ear quadratic regulator over a finite horizon","venue":null,"work_id":"1971e9cb-6474-46fb-83b7-764307db9063","year":2021},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:52.207116Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:67bf5d5bfdddbf225b8a3bdaee55f4641abbb268c9fc93156c8f294e14198667","observation_id":"7367bb92-5693-49f8-989d-86d41753bcb4","resolution":{"observed_at":"2026-08-07T10:25:58.381270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.369899Z","title":"Policy gradient methods find the nash equilib- rium in n-player general-sum linear-quadratic games","venue":null,"work_id":"e69211a5-de57-494d-9774-1e841b5a395b","year":2023},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:52.308626Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:03e85dd6aec00d2568f2bbe5a49f32d7871f256b89e26af4b8b3672000fa1c86","observation_id":"7b08fa9a-7303-454a-82f9-e396cc4d831c","resolution":{"observed_at":"2026-08-07T10:25:58.372977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00282","last_updated":"2025-09-03T03:18:07Z","snapshot_observed_at":"2026-07-06T18:08:00.410061Z","submitted_at":"2024-05-01T02:19:31Z","title":"MF-OML: Online Mean-Field Reinforcement Learning with Occupation Measures for Large Population Games","version":2},"cited_work":{"arxiv_id":"2405.00282","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.00282","snapshot_observed_at":"2026-08-07T10:25:56.824919Z","title":"MF-OML: Online Mean-Field Reinforcement Learning with Occupation Measures for Large Population Games","venue":"math.OC","work_id":"5144fe8a-e700-4e94-903a-fc226da1e07a","year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:52.453170Z"},"links":{"cited_paper":"/paper/2405.00282","citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:8857f1f052c7cbfed6730cc1fd1a30a94cc2e8f474d29e8f8d76b506c141e7a1","observation_id":"7ab5e38b-98e3-41a0-b27d-789487e3e0b5","resolution":{"observed_at":"2026-08-07T10:25:56.883606Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.361082Z","title":"Model-based RL for mean-field games is not statistically harder than single-agent RL","venue":null,"work_id":"dd2eabf6-dca0-4620-a25a-f52cee558e98","year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:52.547369Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:5689979f0b34e18cdbdd7fc8d53d51dce63b68d098f16e8f585c557175c6427a","observation_id":"f9743ba9-84a0-4d46-a4d1-769d8d2caa33","resolution":{"observed_at":"2026-08-07T10:25:58.364277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.352955Z","title":"On the statistical efficiency of mean-field reinforcement learning with general function approximation","venue":null,"work_id":"7d1d6fa7-6e3e-4874-9677-ea5aafd993dc","year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:52.656118Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:c75745bf2b797eb05078e90fdd9fe5d4b63b461543d3126d2728c27dd945c461","observation_id":"f5a3cbd0-5d59-42d6-8dde-eb4278c8ae55","resolution":{"observed_at":"2026-08-07T10:25:58.355754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.344849Z","title":"Malham´ e, and Peter E","venue":null,"work_id":"9a51579d-c9a7-42b6-9e26-d3606f8885e2","year":2006},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:52.806221Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:aae0d5caa1f178de2502e04b5c175f10bc8e2cf541324a468fd57b4b612805a9","observation_id":"95c6d6a1-48f8-4431-a192-d11babe7cdce","resolution":{"observed_at":"2026-08-07T10:25:58.347534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16326","last_updated":"2023-10-25T03:14:48Z","snapshot_observed_at":"2026-07-06T16:38:09.978805Z","submitted_at":"2023-10-25T03:14:48Z","title":"Reinforcement Learning for SBM Graphon Games with Re-Sampling","version":1},"cited_work":{"arxiv_id":"2310.16326","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.16326","snapshot_observed_at":"2026-08-07T10:25:56.635163Z","title":"Reinforcement Learning for SBM Graphon Games with Re-Sampling","venue":"cs.GT","work_id":"97be704f-9c47-436c-a057-bad14653f64f","year":2023},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:52.929133Z"},"links":{"cited_paper":"/paper/2310.16326","citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:4ccc2c6f524c017f6bf149229dd49c474ed14990d3c3613c9c8eac2a2ac6b0ea","observation_id":"d97d0940-69cf-4b85-b549-70b4643ccd2c","resolution":{"observed_at":"2026-08-07T10:25:56.722759Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.336599Z","title":"Real-time bidding with multi-agent reinforcement learning in display advertising","venue":null,"work_id":"1fa48137-6904-4ab0-8d33-727f05f007c3","year":2018},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:53.031245Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:2a74f371a4bcb3b0362ee751b87ec4891d6ea6542918b63f127113c83e56f302","observation_id":"f49b81b1-5b32-4582-a3a9-742c8bc91cd0","resolution":{"observed_at":"2026-08-07T10:25:58.339344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.328771Z","title":"A natural policy gradient","venue":null,"work_id":"b29bc0fd-b2c1-4da5-833a-49e21faedb60","year":2001},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:53.182249Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:a8833347d45cb0d217e90c15d373f48677b1891ea831ad6973017b4ab12b8948","observation_id":"7ed1f384-d10b-4eb2-b5cf-2add752210e1","resolution":{"observed_at":"2026-08-07T10:25:58.331341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02951","last_updated":"2025-06-06T12:01:07Z","snapshot_observed_at":"2026-08-04T14:28:32.395939Z","submitted_at":"2023-10-04T16:41:36Z","title":"A Fisher-Rao gradient flow for entropy-regularised Markov decision processes in Polish spaces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02951","snapshot_observed_at":"2026-08-07T10:25:53.289607Z","title":"A Fisher-Rao gradient flow for entropy-regularised Markov decision processes in polish spaces","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:53.289607Z"},"links":{"cited_paper":"/paper/2310.02951","citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:116cae75bdb497414c35443e57fa9c0dfb3a87f9ba3d872f25950f6ffb44ac87","observation_id":"6de26ac7-ccc6-42f6-924e-b4f45d1856cd","resolution":{"observed_at":"2026-08-07T10:25:53.289607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.320563Z","title":"Actor-critic algorithms","venue":null,"work_id":"f1a73d8e-cbf2-4a71-932d-90e3475dc9ee","year":1999},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:53.374843Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:acc83f69a5a5f0971b45061a30ee29cace0b6160d2765b2a1e04b857ab1cf171","observation_id":"62c2cc9f-ef5f-495d-ac4e-0dee4c654e42","resolution":{"observed_at":"2026-08-07T10:25:58.323352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.312062Z","title":"A label-state formulation of stochastic graphon games and approximate equilibria on large networks.Mathematics of Operations Research, 48:1811–2382, 2022","venue":null,"work_id":"97942030-02d0-4857-bf87-41af54b38972","year":2022},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:53.459363Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:f267ef55a53e50738e2494d1c8b0e3f904e82d9e7d74aa7d98920e1f6e9de15e","observation_id":"858b1adf-c7f9-4d50-8379-7af58a46ea6c","resolution":{"observed_at":"2026-08-07T10:25:58.314990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.304129Z","title":"Mean field games","venue":null,"work_id":"c57c3595-1979-4e82-b17c-f6f1ce15a53b","year":2007},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:53.577904Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:ac7d8fc4c39890cebffc79b4202e10c4f94a08a59d0078335d4ce83351a88268","observation_id":"13e0aa9e-5bce-43cd-8a38-1ac86aa8ce23","resolution":{"observed_at":"2026-08-07T10:25:58.306776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12944","last_updated":"2024-07-26T18:20:46Z","snapshot_observed_at":"2026-08-05T00:27:26.005869Z","submitted_at":"2022-05-25T17:49:37Z","title":"Learning in Mean Field Games: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12944","snapshot_observed_at":"2026-08-07T10:25:53.713354Z","title":"Learning in mean field games: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:53.713354Z"},"links":{"cited_paper":"/paper/2205.12944","citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:ff4187eb8cfbbe1b412ce1a1d79276169e600fc0d75abd22e6373c833b791f7e","observation_id":"a1055e9f-55a4-4063-b2be-b4f652e0f15e","resolution":{"observed_at":"2026-08-07T10:25:53.713354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.293775Z","title":"American Mathematical Society Col- loquium Publications","venue":null,"work_id":"e7dccb5d-edd0-414a-ad08-02836942af39","year":2012},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:53.816578Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:d2372deef2817ef1bf5d65c4f17892fe3099df04a41aa6998c05c90b38dda6ce","observation_id":"acc9d4f3-cd17-48f8-8725-88b75e370f2f","resolution":{"observed_at":"2026-08-07T10:25:58.296721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.285389Z","title":"On the global con- vergence rates of softmax policy gradient methods","venue":null,"work_id":"e690359d-4f15-4727-9e6d-3e65c238e324","year":2020},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:53.946606Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:b0f5e2e74aeed9ae73fc27e66397cd47e03da4bd57f71793ddb79927b9997b1a","observation_id":"1efd3b1b-a6e1-41c3-b455-ca7b01153109","resolution":{"observed_at":"2026-08-07T10:25:58.288192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05896","last_updated":"2024-11-08T15:29:03Z","snapshot_observed_at":"2026-08-06T10:31:53.893963Z","submitted_at":"2024-11-08T15:29:03Z","title":"Stochastic Graphon Games with Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05896","snapshot_observed_at":"2026-08-07T10:25:54.024854Z","title":"Stochastic graphon games with memory","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:54.024854Z"},"links":{"cited_paper":"/paper/2411.05896","citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:ddd9062782fc2abe7c7b7176c9ff050b4479c03ef91bc1808ab06e1af138bf17","observation_id":"21362dd4-02e6-4ad6-a1d4-04b54f59df70","resolution":{"observed_at":"2026-08-07T10:25:54.024854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.06680","last_updated":"2019-12-13T19:56:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-12-13T19:56:40Z","title":"Dota 2 with Large Scale Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.06680","snapshot_observed_at":"2026-08-07T10:25:54.194986Z","title":null,"venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:54.194986Z"},"links":{"cited_paper":"/paper/1912.06680","citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:d3cfaa7fd62b8c3b938f24641dd6659db30174ad95b4df9029bf37419fadb1d6","observation_id":"4bb99848-22c8-4cac-90d6-99b885720120","resolution":{"observed_at":"2026-08-07T10:25:54.194986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.277274Z","title":"Graphon games: A statistical framework for network games and interventions","venue":null,"work_id":"6a083b1f-e8b0-4d22-8c07-73beda99c3d2","year":2023},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:54.367333Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:a7c65b486a1c2c873481fee4744339603d16b6ab59158e9031fa40a46c88785b","observation_id":"c916ef8f-1cbe-44b6-98c1-b40aead4983d","resolution":{"observed_at":"2026-08-07T10:25:58.280044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.268233Z","title":"Time discretization-invariant safe action re- petition for policy gradient methods","venue":null,"work_id":"13c6aa22-b9fe-4259-bd82-41e54db27c45","year":2021},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:54.597645Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:46f037bf7da8942c178d6c25c2a6f24b752676a3f6552e6fac5b42e260792243","observation_id":"06ae224f-521a-4a7a-af7f-51273bf7b88e","resolution":{"observed_at":"2026-08-07T10:25:58.271175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20250","last_updated":"2025-03-24T13:37:48Z","snapshot_observed_at":"2026-07-06T18:22:53.072592Z","submitted_at":"2024-05-30T17:02:18Z","title":"Entropy annealing for policy mirror descent in continuous time and space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20250","snapshot_observed_at":"2026-08-07T10:25:54.770111Z","title":"Entropy annealing for policy mirror descent in continuous time and space","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:54.770111Z"},"links":{"cited_paper":"/paper/2405.20250","citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:0f37b1886f397f6a14a50d5787f440b9ec25637623804b9e9fd923d7a1f37c67","observation_id":"8086cd2c-b1bb-41a8-b175-f2c040dfb26c","resolution":{"observed_at":"2026-08-07T10:25:54.770111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.03295","last_updated":"2016-10-11T12:09:03Z","snapshot_observed_at":"2026-08-03T05:49:14.071341Z","submitted_at":"2016-10-11T12:09:03Z","title":"Safe, Multi-Agent, Reinforcement Learning for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.03295","snapshot_observed_at":"2026-08-07T10:25:54.893054Z","title":"Safe, multi-agent, reinforce- ment learning for autonomous driving","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:54.893054Z"},"links":{"cited_paper":"/paper/1610.03295","citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:964194cd5be2ffb73925aef0ddbff4e0b20b8b98c3c8c71f358834b6848dff58","observation_id":"e8ae0642-33bf-4a24-be32-f7021115328a","resolution":{"observed_at":"2026-08-07T10:25:54.893054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.259933Z","title":null,"venue":null,"work_id":"ca524479-e48e-4c1e-ba00-0aa3a80dcc01","year":2016},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:54.993284Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:61352a29f4dbae76e810a14f09caafc66706da6497f00cc6b30e9d237e0c71ec","observation_id":"12d16d47-64f4-4f3d-be60-99f0e6d88012","resolution":{"observed_at":"2026-08-07T10:25:58.262557Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.251816Z","title":"Deterministic policy gradient algorithms","venue":null,"work_id":"8120915e-55b3-4b1d-ba5a-8ed850d97002","year":2014},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:55.118458Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:aba9511d10a6eb8090e3cc7ed855fd58bf9891d58a4d8654806144c4a5a31a55","observation_id":"38e1ed21-e657-4664-abba-9b397c27886b","resolution":{"observed_at":"2026-08-07T10:25:58.254608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.243306Z","title":"Sutton and Andrew G","venue":null,"work_id":"ec766dd9-86bb-428b-b084-20a594260112","year":2018},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:55.217096Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:a1f8fdccb28abbb17fc32e6338f009103e4151a85c5b02983d0f3e81de1ee533","observation_id":"3c8ff049-5a9f-4a34-b805-ee9926f1a9fe","resolution":{"observed_at":"2026-08-07T10:25:58.246089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.234917Z","title":"Policy gradient methods for reinforcement learning with function approximation","venue":null,"work_id":"42e126d0-98ea-47d8-8fad-b83f407c47fe","year":1999},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:55.288745Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:1a41f94ab93f2fe748e5222142662fde08239e834d34eaa044958a638e34038f","observation_id":"67698907-189d-49f5-9b7e-8f15530d809c","resolution":{"observed_at":"2026-08-07T10:25:58.237861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.226508Z","title":"Caines, and Minyi Huang","venue":null,"work_id":"6d999879-ea4a-438f-b861-d389ed36fcd2","year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:55.380324Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:35fa340ddacb04ecdf79aaa1b19dc28fb2b925abf74c04543833b171eb384323","observation_id":"83bd1352-65d0-40a7-8246-706c1de4042e","resolution":{"observed_at":"2026-08-07T10:25:58.229525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.217678Z","title":"Ordinary Differential Equations and Dynamical Systems, volume 140 ofGradu- ate Studies in Mathematics","venue":null,"work_id":"c1d11374-5659-400e-987b-4cd2cc2284f0","year":2012},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:55.502383Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:2f195f45451a957643ced15ddfec55dffd9e3775975dcce20b143b0fa7781b83","observation_id":"72bcac30-3a04-4b6b-8cae-edf56c682601","resolution":{"observed_at":"2026-08-07T10:25:58.220709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.208432Z","title":"Global convergence of policy gradient for linear-quadratic mean-field control/game in continuous time","venue":null,"work_id":"f961a06b-ebc1-4407-bec5-5903a9328f43","year":2021},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:55.600933Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:d3958a904994e5e853022eee7ba7a59020ece66fccbc4d4f68d3cdd5161d302a","observation_id":"76ebe283-1d2d-43dd-afb8-5bd04ea4373a","resolution":{"observed_at":"2026-08-07T10:25:58.211525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.199552Z","title":"Learning while playing in mean-field games: Convergence and optimality","venue":null,"work_id":"73aa30fe-bbcb-4c0f-abdf-9c8951fdcd27","year":2021},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:55.699378Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:d6d553ee2db9d326a7fad80bb9f99e22082e048e862857b06449ce34c096fef6","observation_id":"24536580-ed8b-408c-ad84-9579b75df894","resolution":{"observed_at":"2026-08-07T10:25:58.202300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09030","last_updated":"2025-07-02T03:33:28Z","snapshot_observed_at":"2026-07-31T19:08:06.221270Z","submitted_at":"2024-01-17T07:55:52Z","title":"Linear-Quadratic Graphon Mean Field Games with Common Noise","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09030","snapshot_observed_at":"2026-08-07T10:25:55.825786Z","title":"Linear-quadratic graphon mean field games with common noise","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:55.825786Z"},"links":{"cited_paper":"/paper/2401.09030","citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:346fa8b3b6830e8b41d240ccea9461cdbe4b546a1f7348c7ae1ad97a7237f4db","observation_id":"20296ccf-e8b7-4bc3-9617-ba463e04787a","resolution":{"observed_at":"2026-08-07T10:25:55.825786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.190959Z","title":"Policy mirror ascent for efficient and independent learning in mean field games","venue":null,"work_id":"a98530cc-ffea-4f9b-8571-85937571b77d","year":2023},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:55.922529Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:60b6de46255e52ec6b09bcd4c7afce40f18cbfdde3a27bf8dc6344ffa1982a57","observation_id":"4b5344fa-0afc-4adc-a7d2-c3c2938c86ad","resolution":{"observed_at":"2026-08-07T10:25:58.194028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:58.181547Z","title":"When is mean-field reinforcement learning tractable and relevant? In Proceedings of the 23rd International Conference on Autonomous Agents and Multiagent Systems , page 2038–2046","venue":null,"work_id":"057de6dc-6139-4d4a-a8d3-197716bbdf67","year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:55.991887Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:4df5cd046836047dc9ea8bfcd7ab939bc72b2f9c65c3c4ca22ae02f91b549138","observation_id":"ff24be89-593a-455b-8716-f8dcd5f494b8","resolution":{"observed_at":"2026-08-07T10:25:58.184842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:57.867756Z","title":"Stochastic Controls: Hamiltonian Systems and HJB Equations","venue":null,"work_id":"835fa864-ca68-428e-bc9b-0dc33cb2058d","year":1999},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:56.087561Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:31284c9fa5153fefd6c31aea098c5fd03cca656775c71425f3d9263b72d70d86","observation_id":"c9ce61b0-55e5-4ec9-8000-0390774079cd","resolution":{"observed_at":"2026-08-07T10:25:58.041054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:57.563588Z","title":"Learning regularized monotone graphon mean-field games","venue":null,"work_id":"7f33080e-e878-45a0-8017-89224165969e","year":2023},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:56.207569Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:476ed88041b8d879d7cbf3cb5e1636d511484e442fe28db0495859ae7573ec84","observation_id":"aeac5648-6171-4005-80f5-15a06d9647db","resolution":{"observed_at":"2026-08-07T10:25:57.702449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:57.309298Z","title":null,"venue":null,"work_id":"b5654a62-b4c8-40b1-9295-7b5ed757a142","year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:56.268960Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:39f7d533e6848f0fbd45c56eee3eefbf3223ad2b7891a0090e47b532d74bb51e","observation_id":"63aba5c9-8a33-473d-ae08-5410e8861d43","resolution":{"observed_at":"2026-08-07T10:25:57.444249Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:57.068022Z","title":"Convergence of policy gradient for stochastic linear quad- ratic optimal control problems in infinite horizon","venue":null,"work_id":"34c2a7c2-bbc1-4f00-ad88-7cd628090f52","year":2025},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:56.358470Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:97f27b0db84dbadafe8210fc29678731a61d91080115d18b31a291e432d16063","observation_id":"bef945bd-b82f-4aea-b744-4dc9ce4270aa","resolution":{"observed_at":"2026-08-07T10:25:57.137627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:25:56.952530Z","title":"Graphon mean field games with a representative player: Analysis and learning algorithm","venue":null,"work_id":"b7ed667d-85ad-4305-8575-0da7aa79fac3","year":2024},"citing_paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T10:25:56.452058Z"},"links":{"citing_paper":"/paper/2506.05894"},"observation_digest":"sha256:0b28b6a6022216b34ea807a8ebb8f31351226a551d86ed2c2040f75f5d55429f","observation_id":"dcf4c283-7e19-4b07-8b49-44d3999aefae","resolution":{"observed_at":"2026-08-07T10:25:57.055423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.05894","last_updated":"2025-06-06T09:06:06Z","latest_version":1,"primary_category":"math.OC","snapshot_observed_at":"2026-08-07T10:10:58.292609Z","submitted_at":"2025-06-06T09:06:06Z","title":"Policy Optimization for Continuous-time Linear-Quadratic Graphon Mean Field Games"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":2,"verified_fuzzy":48},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 0 inbound Pith citation observations for arXiv:2506.05894."}