{"as_of":"2026-08-09T12:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4f1c60c1e4d790f2494d0ba12941af42984d50db720d56b96d3e8369bb8f8d92","coverage":[{"denominator":84,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":84,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:51:56.870832Z","state":"measured"},{"denominator":84,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":84,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.03682/citation-record","integrity":"/paper/2509.03682/integrity","json":"/paper/2509.03682/citation-record.json","paper":"/paper/2509.03682"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:55.329704Z","title":"Video games remain America’s favorite pastime with more than 212 million Americans playing regularly,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.329704Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:546c522106b286f51bc70fcbac1bb532e788cb8c6ccbe69792568e46f9b50eb7","observation_id":"2e3dc315-d850-4fc2-820d-63b97b8903ad","resolution":{"observed_at":"2026-08-05T10:51:55.329704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:55.451538Z","title":"GVR-4-68038-527-4,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.451538Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:129dd91464fda523eeb30ada5d124f7c58e486192b7c7ebcb5b2d6eeee3678e3","observation_id":"4959a035-d10b-4c98-aa5d-b0791b2980a5","resolution":{"observed_at":"2026-08-05T10:51:55.451538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:55.630270Z","title":"2024 essential facts about the U.S. video game industry,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.630270Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:69ea7beab314e8377e5f39ed917e4c160d689ec9fc214d6ef93a96d3d2edeb8b","observation_id":"1a43f34c-6445-4bb8-8323-dd4baa3d197d","resolution":{"observed_at":"2026-08-05T10:51:55.630270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.356727Z","title":"A machine for playing the game Nim,","venue":null,"work_id":"d4ca7f64-114d-407c-b6a5-6b37dd2c0e5a","year":1948},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.633466Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:abf7d513ffa23ba53f9ee202972aa60a8e33773fe8ef9ee994bfafebb75662f3","observation_id":"e821a649-c194-490d-9def-fdce0bc1d069","resolution":{"observed_at":"2026-08-05T10:51:59.359580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.348468Z","title":"Understanding behavior trees,","venue":null,"work_id":"0bd7ba94-a339-4625-9dcc-712e699d894d","year":2007},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.636360Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:51eef8a05af47229fd3b88cfb07f6e52c37d339e5898bd1b0e291d1128d44f10","observation_id":"e781a5bc-48fa-45b4-a7dd-9281d36801f8","resolution":{"observed_at":"2026-08-05T10:51:59.351339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.339824Z","title":null,"venue":null,"work_id":"8970fd2b-f340-4e8e-9e6d-ba9d61e557e2","year":1998},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.639194Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:b10df02b276df835ac78d37cbbe842642843d5de77a4c256dd0c05d95ccf1e21","observation_id":"f00c2ad3-b3e5-46ff-959d-47db68b687d8","resolution":{"observed_at":"2026-08-05T10:51:59.342462Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.331307Z","title":"Using reinforcement learning to solve AI control problems,","venue":null,"work_id":"e4742063-87cb-418d-815f-d1eed0a749aa","year":2004},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.642482Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:93d6e5ff59522278130e7878796d65c68cdaec7a7a6ef77d64f86709910f3743","observation_id":"876ef60d-4a86-4e90-a489-90a9932bb23f","resolution":{"observed_at":"2026-08-05T10:51:59.334265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2011.60334","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.896519Z","title":"Connectionist reinforcement learning for intelligent unit micromanagement in StarCraft,","venue":null,"work_id":"347f444f-ecf5-44d6-90e4-31c7a9cb2870","year":2011},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.645303Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:db026f3e79b0d689842c44ccdc5e48acce7f29a42dcaa993aee108c6f3cc27e9","observation_id":"afddbaf4-788d-4db8-a08b-a3c70c22b08d","resolution":{"observed_at":"2026-08-05T10:51:58.901174Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3652.34238","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.819939Z","title":"Go with the flow: Reinforcement learning in turn-based battle video games,","venue":null,"work_id":"b4ce104e-832f-42a7-b3ce-78942d06ed65","year":2020},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.648388Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:111ed70c90bc65b3ef7cb9a2486d697b2c94d780ae64621e7f3f1494fe6b531c","observation_id":"6b3fadd6-b650-4553-8264-1c341bba557f","resolution":{"observed_at":"2026-08-05T10:51:58.824503Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.322841Z","title":"A review of real -time strategy game AI,","venue":null,"work_id":"4d698b5c-b996-4b1b-8591-e3df4177c08b","year":2014},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.651337Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:d224cd23843965e9792cb4282b4e018fcfad9619b42720e19e8e7d3a01f20ebc","observation_id":"a134d1bf-93f5-4246-a593-2e5bd04fcecd","resolution":{"observed_at":"2026-08-05T10:51:59.325659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.313923Z","title":"Human -level control th rough deep reinforcement learning,","venue":null,"work_id":"c847dec8-dd7b-48be-9886-605bcc1005f9","year":2015},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.653948Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:aabfb6c726187135d1094babf6c7e75c7e63a5675021f2b359f5e5c5c2417bd0","observation_id":"6979e9ac-d099-467c-8fc0-7f161b3142e1","resolution":{"observed_at":"2026-08-05T10:51:59.316847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v31i1.10827","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:56.929372Z","title":"Playing FPS games with deep reinforcement learning,","venue":null,"work_id":"75903f1b-7633-40ec-8bbe-4c15e663d844","year":2017},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.656727Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:745c619485844727aedd29f82da9a67af67799c196521a289fbb3e1e3f5f05e7","observation_id":"24580eec-7934-4082-a9ce-fa355c2ea402","resolution":{"observed_at":"2026-08-05T10:51:56.932869Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.24963/ijcai.2021/294","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:56.920474Z","title":"Deep reinforcement learning for navigation in AAA video games,","venue":null,"work_id":"8aaf8b10-6986-4100-a988-4be5b1baea48","year":2021},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.659201Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:d4741b04b488e46a15a3df2f7bf06508e476f8326f6e2a167c3707cd17d02e20","observation_id":"42a572b5-4734-4521-aef1-a8900594b2fc","resolution":{"observed_at":"2026-08-05T10:51:56.923422Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.305923Z","title":null,"venue":null,"work_id":"b20be821-a966-4369-86ce-191ae035508c","year":2018},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.661751Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:25256d660927f9500725bba2f5391e77094f93c259fb5c2b40c1bf83d9d25ec9","observation_id":"a98459be-091b-4357-911d-0ce793105003","resolution":{"observed_at":"2026-08-05T10:51:59.308553Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.297001Z","title":"Mastering Atari, Go, chess and shogi by planning with a learned model,","venue":null,"work_id":"f86013da-df08-42d2-8844-063bedc91926","year":2020},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.664123Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:8587d8e78a8b3ca54f6446863c87e65d1537f169e5461c6a69f5d0f24f58bbaa","observation_id":"96f95acf-8b31-4010-9a16-ee6f6d426171","resolution":{"observed_at":"2026-08-05T10:51:59.300124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.06449","last_updated":"2021-11-11T20:31:19Z","snapshot_observed_at":"2026-07-06T12:07:45.652474Z","submitted_at":"2021-11-11T20:31:19Z","title":"Expert Human-Level Driving in Gran Turismo Sport Using Deep Reinforcement Learning with Image-based Representation","version":1},"cited_work":{"arxiv_id":"2111.06449","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.06449","snapshot_observed_at":"2026-08-05T10:51:58.760460Z","title":"Expert Human-Level Driving in Gran Turismo Sport Using Deep Reinforcement Learning with Image-based Representation","venue":"cs.AI","work_id":"ae176950-54bc-4394-a722-74d6cbfffa1b","year":2021},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.666721Z"},"links":{"cited_paper":"/paper/2111.06449","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:96e16aef7a3317c80deb7443d86ddd7c3aee5fc85e583c9d3b6a68d9004836be","observation_id":"1d45322b-cde5-4023-b260-d87baeef19e5","resolution":{"observed_at":"2026-08-05T10:51:58.764087Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.288272Z","title":"Super - human performance in Gran Turismo Sport using deep reinforcement learning,","venue":null,"work_id":"e9e8a0b8-c6ba-406d-bb38-98d4ad3be0ff","year":2021},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.669648Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:821a8e3a1bd9f4d4c7bedede03d6084312030938181304096ff2604a1155458a","observation_id":"dd447118-6f53-4b10-91bd-8367c159e9cf","resolution":{"observed_at":"2026-08-05T10:51:59.291440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:55.672432Z","title":"Technical challenges of deploying reinforcement learning agents for game testing in AAA games,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.672432Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:75898d858c3db719c1a05301077f040dc480a47a7e726e421ef9224f64e5061a","observation_id":"818f4044-b49b-41ee-a22d-c328542eb0d3","resolution":{"observed_at":"2026-08-05T10:51:55.672432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.279936Z","title":"TD -Gammon, a self -teaching backgammon program, achieves master-level play,","venue":null,"work_id":"8cc435e5-173e-41bb-9109-df29322be784","year":1994},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.675255Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:c328fd8efa94e45d869444e9bd38e107fa53848e2375e293fe9f81518cfd2571","observation_id":"026565d2-c4ec-4647-bf27-6904c55f6a51","resolution":{"observed_at":"2026-08-05T10:51:59.282817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.271085Z","title":"Mastering the game of Go with dee p neural networks and tree search,","venue":null,"work_id":"0b4bdb6d-6dee-4277-9fc1-6bb76001eff4","year":2016},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.678691Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:9b22bb27709508cdcfa1a95985648a52484956acefbddd5e40ac9e37dfe631e2","observation_id":"dfd2c73a-3f25-4751-b5b4-afd271f86c32","resolution":{"observed_at":"2026-08-05T10:51:59.273906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.262720Z","title":"Mastering the game of Go without human knowledge,","venue":null,"work_id":"7275a011-e38f-46e1-8946-8d041effe961","year":2017},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.681980Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:abb3b44957f260c9b1473f081f0b2f54ed8c404719c67a143266bd5803752ff7","observation_id":"eb4bf056-0c5d-49fd-8ebe-748b7f4ed752","resolution":{"observed_at":"2026-08-05T10:51:59.265704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.254094Z","title":"A general reinforcement learning algorithm that masters chess, shogi, and Go through self -play,","venue":null,"work_id":"81052f52-f6dd-4044-901b-6ab5efe378af","year":2018},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.684847Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:8bd8c0771be897f6a90e06ad6fbd0eebee3a5c6358b0117e6b3a0df244a64927","observation_id":"5b3b063c-cc52-466b-a99b-cd092439fefd","resolution":{"observed_at":"2026-08-05T10:51:59.257313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.245824Z","title":"Grandmaster level in StarCraft II using multi -agent reinforcement learning,","venue":null,"work_id":"101f867c-ba03-45ea-90f3-20dc840ad080","year":2019},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.687801Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:51b0f2fcda33b70c6f870ae445c5becfbefd45b12f764f149426db79fdfc9140","observation_id":"3f05b17c-0595-4caf-ac47-7fb4af6f2566","resolution":{"observed_at":"2026-08-05T10:51:59.248530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.06680","last_updated":"2019-12-13T19:56:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-12-13T19:56:40Z","title":"Dota 2 with Large Scale Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.06680","snapshot_observed_at":"2026-08-05T10:51:55.691234Z","title":"Dota 2 with larg e scale deep reinforcement learning,","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.691234Z"},"links":{"cited_paper":"/paper/1912.06680","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:96fc86a45435c55c8a35715ed05cdd5f46e045b4db5664daadd4945f88ede874","observation_id":"3950dc73-be06-4b29-a8fc-56182e26c553","resolution":{"observed_at":"2026-08-05T10:51:55.691234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2007.91391","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.678607Z","title":"A comprehensive survey of multiagent reinforcement learning,","venue":null,"work_id":"eaca5bde-7b10-47c1-a0c2-f7dec343489e","year":2008},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.694691Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:03bdca1a53ad19d45ec5759ea4ad3f83c759d15846d9b28656b808fd35127c39","observation_id":"a5d431b0-ccab-4b04-a14e-1adfbdc53f0f","resolution":{"observed_at":"2026-08-05T10:51:58.683334Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:55.697893Z","title":"Multi-agent reinforcement learning: A selective overview of theories and algorithms,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.697893Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:985d01296aa66a9b9b3975c856225dc31f01965bd279487ea66668ad467ba2c2","observation_id":"47c781be-8671-40e4-b91a-5110e6615ef6","resolution":{"observed_at":"2026-08-05T10:51:55.697893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.237374Z","title":"Deep reinforcement learning for multiagent systems: A review of challenges, solutions, and applications,","venue":null,"work_id":"68cf263d-cad7-4b08-a656-2e0b8332a7a3","year":2020},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.701361Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:f92a410aa2c65b8c361eb85852469e48107f5e27ff653e59e988f3cc3f4b961f","observation_id":"b6ef752c-d339-4902-b255-d84b16bc6bcc","resolution":{"observed_at":"2026-08-05T10:51:59.240497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.228837Z","title":"Multi-agent reinforcement learning: A review of challenges and applications,","venue":null,"work_id":"e901d237-b2e7-44a8-a9a4-c7bdc377661f","year":2021},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.704424Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:7005b41802fbc0f0fd44d43949f98b70cc29c5d194e35fe38571b0fe0e26477a","observation_id":"582067ed-b6a6-48c8-ad1d-849f26540707","resolution":{"observed_at":"2026-08-05T10:51:59.231992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.220639Z","title":"Deep learning for video game playing,","venue":null,"work_id":"ec73081c-238a-4e2f-8f8d-f2ca652993b6","year":2020},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.707328Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:6827df2e80e2678056c33a6957193b1c3f02bcdcf1b544446bdc481a857cac55","observation_id":"fd6815f2-17ce-4627-9772-3248d1cb51fe","resolution":{"observed_at":"2026-08-05T10:51:59.223337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.212032Z","title":"Reinforcement learning in game industry—Review, prospects and challenges,","venue":null,"work_id":"3e23d032-c847-49cb-a7cf-5413d38aff47","year":2023},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.717199Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:b4cc55bad6aae04f234528d8d978624fadd21034a455604ec2cf0a4f4c5d9411","observation_id":"f5e1955c-1ac4-4787-9075-f8c746809685","resolution":{"observed_at":"2026-08-05T10:51:59.215027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.203584Z","title":"Q-learning,","venue":null,"work_id":"903b560a-f313-4838-b333-97f0ca106418","year":1992},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.720267Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:aeb3bb1c1d28a18ea22d55590162dc7e297a2fe4e2d3071f5a1fa216fef0236d","observation_id":"320a8eb4-aeef-487f-8896-f017739cd99e","resolution":{"observed_at":"2026-08-05T10:51:59.206478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.195462Z","title":"Policy gradient methods for reinforcement learning with function approximation,","venue":null,"work_id":"85b54e42-0650-4f7f-b66d-4984acfa9d27","year":1999},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.723483Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:23ad4dc07bffc16a8ffd7436e02876af09dbc31fb71867e0d43c903ada58e201","observation_id":"54ac3f35-93ab-4148-a257-9fe103b35e6d","resolution":{"observed_at":"2026-08-05T10:51:59.198183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.186892Z","title":"Wooldridge, An Introduction to MultiAgent Systems , 2nd ed","venue":null,"work_id":"ee052ca7-c0f5-4785-988d-17855a2115d0","year":2009},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.726589Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:380a25bcff18d4f49f5af7064278898c1f79db46c19bfb84008666763b2aa7d2","observation_id":"7c7cb991-9f4c-41e6-922b-a6089de2e0f6","resolution":{"observed_at":"2026-08-05T10:51:59.189913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.178592Z","title":"Modular AI,","venue":null,"work_id":"25139dd7-231e-4095-9c5b-23163a37e1a5","year":2017},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.729621Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:898f3d3177f9914c68e9b0503416f517b422d3e72c9095bb5d0da77b7c2ee0e3","observation_id":"271dff9a-a9b8-4df8-9075-6fabca00527f","resolution":{"observed_at":"2026-08-05T10:51:59.181168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.170441Z","title":"Long short -term memory,","venue":null,"work_id":"c94feba5-dfb2-48e8-9ff2-01802b2558e4","year":1997},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.732768Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:a287399c2b5c955125bc1093c391fbf1e80b508642f2b4ca2b4f2ae9193f1710","observation_id":"c5152184-8050-4e87-bb6f-292723c8c0d7","resolution":{"observed_at":"2026-08-05T10:51:59.173091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.162087Z","title":"Deep recurrent Q -learning for partially observable MDPs,","venue":null,"work_id":"c7e421fd-dd74-467b-ab0a-12e0713beec1","year":2015},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.735651Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:cc2b68697939a87484959c4f8a95944b5d6db06026be6084aa4bfe782cc4c7a1","observation_id":"240dde50-bde1-4897-9eae-01f42ef520d2","resolution":{"observed_at":"2026-08-05T10:51:59.165087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.153661Z","title":"Rainbow: Combining improvements in deep reinforcement learning,","venue":null,"work_id":"05012b16-7725-47e0-a1c1-adc70ad38e8a","year":2018},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.739171Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:031e1e6d2c0916d9c9afe33bea4324ebd090eac40dfd80be6c39cd3db5c92fcb","observation_id":"4185fa3e-7f39-4282-a920-c12c015e12ba","resolution":{"observed_at":"2026-08-05T10:51:59.156750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.145147Z","title":"Actor-critic algorithms,","venue":null,"work_id":"185fd42b-92df-48bf-9793-967ee6694fb0","year":2000},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.742552Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:9b81a57b33c7e68e5d10830542d78de64578c59f0b7d93dc7ff7286199ba409a","observation_id":"c0f59460-76f9-4e9d-ab05-a7c921e5764a","resolution":{"observed_at":"2026-08-05T10:51:59.148062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-05T10:51:55.745729Z","title":"Continuous control with deep reinforcement learning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.745729Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:fb6c7d4d0921c20a9b0effccb9b3651bf95f3dab9e1bb43eb482e95aae010693","observation_id":"d5e8b191-0414-4978-b80f-ae085f5f78d0","resolution":{"observed_at":"2026-08-05T10:51:55.745729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T10:51:55.749220Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.749220Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:b12935a2cfe3ec4a2f8a0aeaf2409ef18612e5e59a8da805e5d417ab71e72b6e","observation_id":"e00150c8-e970-4b99-a887-2b0c88d917c7","resolution":{"observed_at":"2026-08-05T10:51:55.749220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:55.752466Z","title":"Shoham and K","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.752466Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:733805318f4994b49e125a0a6606b12a1bb6d4b812e79a7f01ba018ce944ccac","observation_id":"3e8f741e-bf32-47b2-a334-188455af2349","resolution":{"observed_at":"2026-08-05T10:51:55.752466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.135768Z","title":"Markov games as a framework for multi -agent reinforcement learning,","venue":null,"work_id":"a055556a-b547-4401-b242-eb3d6d38d4ce","year":1994},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.755645Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:35413569a7db0c927466c3fa32a1f3cc476d08f0d444c4dbaea651f2a75ddafe","observation_id":"5c2b3359-e747-4b8b-a572-6b9c88c8d7b2","resolution":{"observed_at":"2026-08-05T10:51:59.138716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.127102Z","title":"Multiagent reinforcement learning: Theoretical framework and an algorithm,","venue":null,"work_id":"fbd09f8b-1b35-4073-a8c6-85aa1a6e3768","year":1998},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.759034Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:5e1ad19a19c5ebf0b526d237559b549e216fc6fbae626dce6abc62da469cab7c","observation_id":"35e12052-9979-4661-b672-7cf6d0025978","resolution":{"observed_at":"2026-08-05T10:51:59.129920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04782","last_updated":"2017-08-16T06:20:52Z","snapshot_observed_at":"2026-07-06T05:55:27.598127Z","submitted_at":"2017-08-16T06:20:52Z","title":"StarCraft II: A New Challenge for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.04782","snapshot_observed_at":"2026-08-05T10:51:55.762086Z","title":"StarCraft II: A new challenge for reinforcement learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.762086Z"},"links":{"cited_paper":"/paper/1708.04782","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:a70ca1d824221ab79a7ec62b78810272a83d840a6d1bfb0e67a9f1f31fa9b847","observation_id":"8902f8c8-294d-4d93-add5-e6776e5ee564","resolution":{"observed_at":"2026-08-05T10:51:55.762086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-09T00:58:24.558416Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-05T10:51:55.765630Z","title":"The StarCraft multi -agent challenge,","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.765630Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:742158bbb9173b83627878d37596ee9558462f9e9d18bf81d0b5f3abb812ec05","observation_id":"5306b4e4-2b89-4618-b7ec-3ee871a64e7c","resolution":{"observed_at":"2026-08-05T10:51:55.765630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0875.11808","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.543259Z","title":"Strangers and friends,","venue":null,"work_id":"5dc61e71-95e5-4bd4-8bc7-857d62e97c94","year":2006},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.769658Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:b79b90f59cd1c0f09428407988318c981124b2762f60d80d505b7c8d8a58c624","observation_id":"fc3e5dbe-5ac3-47c7-acaf-b65725809964","resolution":{"observed_at":"2026-08-05T10:51:58.549403Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v33i01.33011206","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:56.896794Z","title":"Hierarchical macro strategy model for MOBA game AI,","venue":null,"work_id":"050e8629-fe52-4cd6-8209-411f1bb2d8bb","year":2019},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.773168Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:547e7c22651406e9cca92dd1c9dbee0ec7ec0c27b861a8e4c632b5856d4f5b2c","observation_id":"c9fddd94-74a2-4742-9f6a-bbdb43bbfc84","resolution":{"observed_at":"2026-08-05T10:51:56.901678Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.118550Z","title":"Unifying temporal and structural credit assignment problems,","venue":null,"work_id":"6f42ad51-3ffe-47b7-96ff-58725f1ed9cf","year":2004},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.776471Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:d46c8b0773bc76faa1447e51f8fa723fe0232177ac023288597075a75cbe0823","observation_id":"b5b8daba-1c1d-48aa-9ce3-dcf29d763bbf","resolution":{"observed_at":"2026-08-05T10:51:59.121596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.109869Z","title":"Multiagent systems: A survey from a machine learning perspective,","venue":null,"work_id":"d3ea6ecb-add7-40af-b272-02fbc03f5b58","year":2000},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.780653Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:ba18ba254591c6b6430c56c98272211c772e305836f7513d82d89b5d615f71c1","observation_id":"082d136e-6184-4726-8ff8-1a16689a4d5b","resolution":{"observed_at":"2026-08-05T10:51:59.112885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.101595Z","title":"Temporal difference learning and TD-Gammon,","venue":null,"work_id":"a1a24db0-4829-4822-9bf2-ba0e116813d4","year":1995},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.783776Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:0bff688669355cf11faed9737f860db943dc3fdca99c3488b05ad2e3fd0527a4","observation_id":"b444575f-b6e4-4039-a178-70caab8228eb","resolution":{"observed_at":"2026-08-05T10:51:59.104463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.092298Z","title":"Creating pro-level AI for a real -time fighting game using deep reinfo rcement learning,","venue":null,"work_id":"07f71edb-602c-4c9b-a99e-3deb29fbaa08","year":2022},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.786788Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:507632f2fcd06fc1fae49fd6965d24390dcd5cf76615f64b72c0ed640246733b","observation_id":"41f21917-81ed-417a-bbdb-01d46b2ab0d2","resolution":{"observed_at":"2026-08-05T10:51:59.095717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.083663Z","title":"On the utility of learning about humans for human-AI coordination,","venue":null,"work_id":"872251e7-2287-44bd-b8c4-9de86794999d","year":2019},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.790699Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:b122efaa8224dcc3efcaa006309424745922889d61aef6e03f60c6d9874aa1b5","observation_id":"eeed4ad4-a83b-4536-8958-ff13cd1f0f2c","resolution":{"observed_at":"2026-08-05T10:51:59.086582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.073086Z","title":"IMPALA: Scalable distributed deep -RL with importance weighted actor -learner architectures,","venue":null,"work_id":"014d8a1b-3a38-4786-92fc-74a522c5c620","year":2018},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.797249Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:2851f77ca0ce6d522e3f8aee236ecba203ff14b013e75d2f0e30f22505ae9df7","observation_id":"c7166dbd-189a-4e17-a3c9-2a5a0656d18c","resolution":{"observed_at":"2026-08-05T10:51:59.077970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.00933","last_updated":"2018-03-02T16:21:46Z","snapshot_observed_at":"2026-07-06T06:26:20.207918Z","submitted_at":"2018-03-02T16:21:46Z","title":"Distributed Prioritized Experience Replay","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.00933","snapshot_observed_at":"2026-08-05T10:51:55.800948Z","title":"Distributed prioritized experience replay,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.800948Z"},"links":{"cited_paper":"/paper/1803.00933","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:22ee8bfa5736068a15ab4f9949bd363b1a26d0389fe5fb5ed117977396913b29","observation_id":"553d7982-96b7-43f5-b711-3a185e24236b","resolution":{"observed_at":"2026-08-05T10:51:55.800948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.063746Z","title":"Make a more engaging game w/ ML -Agents | Machine learning bots for game development | Reinforcement learning | Unity","venue":null,"work_id":"e12f12be-0317-47cf-aa59-f804531f5478","year":null},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.804667Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:4d54f7f50b06f835bc5bce27bb739d156c055811868a9d627d694733530b2dd9","observation_id":"5565a883-acd2-49b2-b9f5-2cbba4b28c59","resolution":{"observed_at":"2026-08-05T10:51:59.066823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.06031","last_updated":"2020-12-10T23:53:15Z","snapshot_observed_at":"2026-08-05T18:03:11.537612Z","submitted_at":"2020-12-10T23:53:15Z","title":"Reinforcement Learning Agents for Ubisoft's Roller Champions","version":1},"cited_work":{"arxiv_id":"2012.06031","doi":null,"metadata_source":"pith","pith_arxiv_id":"2012.06031","snapshot_observed_at":"2026-08-05T10:51:57.248855Z","title":"Reinforcement Learning Agents for Ubisoft's Roller Champions","venue":"cs.LG","work_id":"1a478c1f-9399-4674-b8a7-97ed4974fb28","year":2020},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.807744Z"},"links":{"cited_paper":"/paper/2012.06031","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:3816ded77d8afe2b895b7ed943a3cc3954092679fcece9edd3f11582400e32fc","observation_id":"054b1f78-c6ba-4b25-88e1-afee7779b33a","resolution":{"observed_at":"2026-08-05T10:51:57.252051Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.055139Z","title":"MonoBehaviour.FixedUpd ate,","venue":null,"work_id":"9338f0c3-45b4-462e-b080-efa26e66d5cd","year":2024},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.811103Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:3f20446d74a02d920efabc5db3b7d1a097eeceb4d57fe4b6cc1765330fb1b42b","observation_id":"edc2a936-49b7-4ec0-979d-91ac9037ea7b","resolution":{"observed_at":"2026-08-05T10:51:59.058040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:55.816478Z","title":"On the verge of solving Rocket League using deep reinforcement learning and sim -to-sim transfer,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.816478Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:c9b0406a045e77f1962168a83692c28c86b2dbd463f3fd317012a1922a01a175","observation_id":"df03024e-f9fc-4dd5-b893-03ac76d1ca89","resolution":{"observed_at":"2026-08-05T10:51:55.816478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:55.833322Z","title":"On the potential of Rocket League for driving team AI development,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.833322Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:e8422ba4fdaf938fc789f3138d9b0cc5d9a11e0c808698cd72ac6ce9f32497c8","observation_id":"ae116335-4acc-41bd-a285-294bdef4c91d","resolution":{"observed_at":"2026-08-05T10:51:55.833322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.046307Z","title":"Lucy - SKG: Learning to play Rocket League efficiently using deep reinforcement learning,","venue":null,"work_id":"9244a691-6ea6-4648-8bd9-6fd9842bcdee","year":null},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.954533Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:48ca5fa4efe9e72da2717f38e091d4512f301a3165bfbd27de511fa53c10c3f9","observation_id":"094bd1ae-03e0-4684-a67a-1824421a36c1","resolution":{"observed_at":"2026-08-05T10:51:59.049561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.037954Z","title":"RLGym: Reinforcement learning in Rocket League,","venue":null,"work_id":"43da6e0f-65b3-4a7b-ac39-c52ac1498d92","year":2024},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.026084Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:3dd4dbf00295dd126087dda907bdbb43b97ce8ad9d188cd789e68151bd921b83","observation_id":"9eb748f6-de58-4633-a415-2ce34a92f1e0","resolution":{"observed_at":"2026-08-05T10:51:59.040763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.029980Z","title":"Attention is all you need,","venue":null,"work_id":"d827c7f7-32fc-4f4a-895f-83bde97c2ec2","year":2017},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.079281Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:640c0bb741e82d76f2827199edb4dea7492081738fab10a00db0e9fc9e1f8b75","observation_id":"63952c26-80dc-4eae-b2dc-282e6a0bf633","resolution":{"observed_at":"2026-08-05T10:51:59.032720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2016.78604","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:57.146197Z","title":"ViZDoom: A Doom-based AI research platform for visual reinforcement learning,","venue":null,"work_id":"952fccb6-2fe9-4546-ab96-4a0f1daed762","year":2016},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.136791Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:d07bf53b57b75c9e2e7a628005abdbcf2da8dbc1a33b83b02acca95e2efe678a","observation_id":"5764aed7-f6c3-4485-8d58-538e0a4c93ee","resolution":{"observed_at":"2026-08-05T10:51:57.151109Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.021530Z","title":"ViZDoom competitions: Playing Doom from pixels,","venue":null,"work_id":"75808f21-e0de-4551-ba55-716ef819a2c7","year":2019},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.164586Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:7dcb7c658ee93aeeceb1be3aad52c5eeca484f25ba723fdbdbf198b39d75e111","observation_id":"19a7ccd9-0741-4dec-9c58-31546c90237f","resolution":{"observed_at":"2026-08-05T10:51:59.024639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.013025Z","title":"Training agent for first -person shooter game with actor-critic curriculum learning,","venue":null,"work_id":"e9878f44-45b6-4e11-b7f4-55da3ef99241","year":2016},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.181626Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:278aa5c4c01523a16348d1ce652c5b32626befcd2bd676aeb27ee870fc223c83","observation_id":"5b694b81-2fec-4a90-aebe-9f8a40f199b9","resolution":{"observed_at":"2026-08-05T10:51:59.015956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1602.01783","last_updated":"2016-06-16T16:38:45Z","snapshot_observed_at":"2026-07-06T04:45:11.148515Z","submitted_at":"2016-02-04T18:38:41Z","title":"Asynchronous Methods for Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1602.01783","snapshot_observed_at":"2026-08-05T10:51:56.247540Z","title":"Asynchronous methods for deep reinforcement learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.247540Z"},"links":{"cited_paper":"/paper/1602.01783","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:ba451b2fe4f662c5b19252155b5beb17b63dcd170c1ebfbff4e75d7d9a439a0f","observation_id":"248a5cbe-6cef-4ebd-8c7d-b93670f362d6","resolution":{"observed_at":"2026-08-05T10:51:56.247540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:59.004822Z","title":"A Mi necraft-based simulated task environment for human-AI teaming,","venue":null,"work_id":"735ab154-ef0e-43f8-b541-b674238a9818","year":2023},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.364463Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:3ceb826d375326e0b13327516728c17d9abb47b1167a5aa641282db003e6af45","observation_id":"49c5c432-aa1e-4b8b-b95f-9775516cd58f","resolution":{"observed_at":"2026-08-05T10:51:59.007758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.996208Z","title":"Minecraft as an experimental world for AI in robotics,","venue":null,"work_id":"1c82e800-b06a-40e2-9c2d-73c924b16d0c","year":2015},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.478414Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:6c792d3f5c906e8e3407d1c799d78c3777f01ac268a5149e2e162bd8214ad636","observation_id":"2b02d60e-b1cd-4ceb-afe1-53f4c027e04f","resolution":{"observed_at":"2026-08-05T10:51:58.999155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.13440","last_updated":"2019-07-29T18:10:30Z","snapshot_observed_at":"2026-07-06T08:11:28.806130Z","submitted_at":"2019-07-29T18:10:30Z","title":"MineRL: A Large-Scale Dataset of Minecraft Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.13440","snapshot_observed_at":"2026-08-05T10:51:56.541888Z","title":"MineRL: A large -scale dataset of Minecraft demonstrations,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.541888Z"},"links":{"cited_paper":"/paper/1907.13440","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:0658b1d76d5b5db4aee20cd1b3465c933461a45620996cbb9415fa7d2547fd28","observation_id":"f5cf9446-1f41-4d73-a477-67dceeaac09b","resolution":{"observed_at":"2026-08-05T10:51:56.541888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.987725Z","title":"The Malmo platform for artificial intelligence experimentation,","venue":null,"work_id":"3f68fb01-4908-4bcb-8fd7-b1be183ca2ad","year":2016},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.639919Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:b3ddda2d4780acb91e369623cbd108fb3ed4c84db22a8bd202fb3a7b44002a1a","observation_id":"db2aee90-238f-43b6-830a-971aa0f9aade","resolution":{"observed_at":"2026-08-05T10:51:58.990767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.979526Z","title":"The Malmo Collaborative AI Challenge - Microsoft Research,","venue":null,"work_id":"d59b9dee-6ab2-49ab-9ae3-b62553d12c92","year":2022},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.749020Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:0b113ef4fc200637bccc3236cb52e4889a410aa4513dfd9bc26113aa8e5c2a8a","observation_id":"01c0b6c7-1d91-4fe5-a6dd-ee4af71c91fc","resolution":{"observed_at":"2026-08-05T10:51:58.982508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.970962Z","title":"HogRider: Champion agent of Microsoft Malmo collaborative AI challenge,","venue":null,"work_id":"c5f9a449-8a04-4f9f-a9e4-5da4bc2e4bfb","year":2018},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.839927Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:074beaa92e8c6eba6731cd59afdf10445d5678d7c3c5ef182c0f2afc7e1497b5","observation_id":"7cec5d4a-6e77-4cf2-902d-0dc251050807","resolution":{"observed_at":"2026-08-05T10:51:58.973783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.08129","last_updated":"2025-04-11T11:14:27Z","snapshot_observed_at":"2026-08-06T02:17:52.954912Z","submitted_at":"2019-01-23T21:01:27Z","title":"The Multi-Agent Reinforcement Learning in Malm\\\"O (MARL\\\"O) Competition","version":2},"cited_work":{"arxiv_id":"1901.08129","doi":null,"metadata_source":"pith","pith_arxiv_id":"1901.08129","snapshot_observed_at":"2026-08-05T10:51:56.964429Z","title":"The Multi-Agent Reinforcement Learning in Malm\\\"O (MARL\\\"O) Competition","venue":"cs.AI","work_id":"0182dfd3-7770-4cf1-a439-8d907eed5967","year":2019},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.843854Z"},"links":{"cited_paper":"/paper/1901.08129","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:6adcb27e5a9bde6bad4d8d59a3c9eea7b28e3b52ffad3acbc078a6640560c956","observation_id":"7a5f6f14-9b39-45ac-ac7d-23ee78b5bfe8","resolution":{"observed_at":"2026-08-05T10:51:56.968079Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.962321Z","title":"Human-level performance in 3D multiplayer games with population -based reinforcement learning,","venue":null,"work_id":"974bcdd7-a8ee-4df3-abb8-0dccab6b604c","year":2019},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.846950Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:bcd3e5fb747acf7587c16cd51570a1a518dd3bedbc3d4f5a58c82f56bc5b559b","observation_id":"196001a9-ce51-4e74-91b1-467615f4bc88","resolution":{"observed_at":"2026-08-05T10:51:58.965344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.953705Z","title":"The exploration - exploitation dilemma: A multidisciplinary framework,","venue":null,"work_id":"97df7141-c9ad-4d36-bb51-78861b1cbbbd","year":2014},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.849629Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:8827944f6df1ffc31ead8c94d3a2c46cbe588df9d3abc6c63f852d49016300ee","observation_id":"c3f383b5-3c07-40f8-ae77-efa9cff09a02","resolution":{"observed_at":"2026-08-05T10:51:58.956756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.944827Z","title":"AlphaStar: Mastering the real -time strategy game StarCraft II,","venue":null,"work_id":"e06bd273-be82-434b-be2b-543c971f1660","year":2019},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.852283Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:f2de330da41d0cdbfa00a66e02f39994bddaf74ff22fe05394036664a5962965","observation_id":"f1e90818-862a-43aa-91f7-a7fc0841c3eb","resolution":{"observed_at":"2026-08-05T10:51:58.947906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.935453Z","title":"Grid-wise control for multi-agent reinforcement learning in video game AI,","venue":null,"work_id":"b249f7f9-6bc2-41e4-b3f4-165e05f60840","year":2019},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.855374Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:de9f83b60b2f481fab196ad6d8efbb3fc45887fba8725759fc546c248d0a3342","observation_id":"e5d1e515-c21c-4c48-9e89-6d7513a017fa","resolution":{"observed_at":"2026-08-05T10:51:58.938545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.10069","last_updated":"2017-09-14T12:45:46Z","snapshot_observed_at":"2026-07-06T05:35:43.650268Z","submitted_at":"2017-03-29T14:37:25Z","title":"Multiagent Bidirectionally-Coordinated Nets: Emergence of Human-level Coordination in Learning to Play StarCraft Combat Games","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.10069","snapshot_observed_at":"2026-08-05T10:51:56.858825Z","title":"Multiagent bidirectionally-coordinated nets: Emergence of human-level coordination in learning to play StarCraft combat games,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.858825Z"},"links":{"cited_paper":"/paper/1703.10069","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:1cabd57e5760353cd0f4d3c5746f4f976592896778d27d4477f7d114986245d7","observation_id":"9df9b4dd-c55f-429e-87de-0df495dda9e0","resolution":{"observed_at":"2026-08-05T10:51:56.858825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.925742Z","title":"Ye, et al., Towards playing full MOBA games with deep reinforcement learning, vol","venue":null,"work_id":"f413b4db-56e5-4713-a753-1b92971ff355","year":2020},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.862563Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:365658c999c93ddb54bb337221fdb6fb221ff37a3a161b532c28801b766aa101","observation_id":"eff00d2b-5e4c-4e9d-9932-004e4866158b","resolution":{"observed_at":"2026-08-05T10:51:58.928821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.917045Z","title":"A recommender system for hero line-ups in MOBA games,","venue":null,"work_id":"585ae0ec-0f95-4db2-8be0-cde04952f3aa","year":2017},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.865286Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:11834a4e9651866df19de4d5fc5e96f4539d9576ebf173d70b5e43d21390541d","observation_id":"80e174de-bc66-4a8d-82ef-3ad4065713ba","resolution":{"observed_at":"2026-08-05T10:51:58.920163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.10130","last_updated":"2018-06-26T17:59:09Z","snapshot_observed_at":"2026-08-01T20:49:18.736728Z","submitted_at":"2018-06-26T17:59:09Z","title":"The Art of Drafting: A Team-Oriented Hero Recommendation System for Multiplayer Online Battle Arena Games","version":1},"cited_work":{"arxiv_id":"1806.10130","doi":null,"metadata_source":"pith","pith_arxiv_id":"1806.10130","snapshot_observed_at":"2026-08-05T10:51:56.942456Z","title":"The Art of Drafting: A Team-Oriented Hero Recommendation System for Multiplayer Online Battle Arena Games","venue":"cs.AI","work_id":"46eb2541-6d9b-4ab8-bf2e-bc91c6479a9b","year":2018},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.867925Z"},"links":{"cited_paper":"/paper/1806.10130","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:ac399515ab3ec2056795f8acee078bfa33acf14752de3d077645222ac235bcb4","observation_id":"7cf67657-3f80-4647-87b7-b2cd5872e63d","resolution":{"observed_at":"2026-08-05T10:51:56.945969Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:58.906884Z","title":"Acting with style: Towards designer-centred reinforcement learning for the video games industry,","venue":null,"work_id":"55c60f22-cb98-4c5c-82d3-57fc26d26f7b","year":2021},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:56.870832Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:e1ca123f2ad7c775d02391fa8f84a3aa4aa80e35e04e0eb37a09ef73b31e367d","observation_id":"36fbe881-e683-4567-876b-e6edf724df5f","resolution":{"observed_at":"2026-08-05T10:51:58.911380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.10944","last_updated":"2019-12-26T14:47:34Z","snapshot_observed_at":"2026-07-06T08:46:35.151523Z","submitted_at":"2019-12-23T16:04:40Z","title":"A Survey of Deep Reinforcement Learning in Video Games","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.10944","snapshot_observed_at":"2026-08-05T10:51:55.714335Z","title":"Available: https://arxiv.org/abs/1912.10944","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.714335Z"},"links":{"cited_paper":"/paper/1912.10944","citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:adecf231d7875a146d6b8584f99ae081d8fb5d97383d452c72e80daebe0b37f6","observation_id":"418233a4-e818-4275-857a-7746f2530211","resolution":{"observed_at":"2026-08-05T10:51:55.714335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:51:55.545689Z","title":"Available: https://www.grandviewresearch.com/ industry-analysis/video-game-market","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T10:51:55.545689Z"},"links":{"citing_paper":"/paper/2509.03682"},"observation_digest":"sha256:c323058ce427c41cbdd5f167749b45d3e38c979ae06b967bbd56e4e920ec0914","observation_id":"b57a8584-71b8-4c2a-97c9-eca9497c757d","resolution":{"observed_at":"2026-08-05T10:51:55.545689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.03682","last_updated":"2025-09-03T20:05:58Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T19:28:34.256554Z","submitted_at":"2025-09-03T20:05:58Z","title":"A Comprehensive Review of Multi-Agent Reinforcement Learning in Video Games"},"reference_resolution":{"displayed":84,"state_counts":{"malformed_identifier":0,"metadata_mismatch":5,"parse_uncertain":0,"unresolved":21,"verified_exact":7,"verified_fuzzy":51},"total_outbound_references":84},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 84 of 84 outbound references and 0 inbound Pith citation observations for arXiv:2509.03682."}