{"as_of":"2026-08-04T01:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:38c1bb1f5ffeb0fb6a5f17cec86217ba2a2f607773e37b432cea1075712c9297","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-03T06:30:56.289259+00:00","state":"measured"},{"denominator":42,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T00:21:00.300581Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-10T06:15:00.866473Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2507.15351","last_updated":"2026-04-16T08:13:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-21T08:04:31Z","title":"One Step is Enough: Multi-Agent Reinforcement Learning based on One-Step Policy Optimization for Order Dispatch on Ride-Sharing Platforms","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-19T04:30:49.870610Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2507.15351"},"observation_digest":"sha256:906015676c4682d5d9e67a43dc83f1d329bafa35c3d4ec0695c04903b7b4f071","observation_id":"b99431d3-2252-4f03-b794-098f943e8cf2","resolution":{"observed_at":"2026-05-19T04:32:03.586785Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2508.01049","last_updated":"2026-05-13T06:44:44Z","snapshot_observed_at":"2026-08-03T03:51:19.181251Z","submitted_at":"2025-08-01T20:07:25Z","title":"Centralized Adaptive Sampling for Reliable Co-Training of Independent Multi-Agent Policies","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-19T01:05:17.086399Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2508.01049"},"observation_digest":"sha256:fb5f34258c4888ceababb222d01df6f2ac3ff6e42dbd34a2ed39f0fcacb1f5f9","observation_id":"40c7aafe-1818-47aa-bfd5-9d4235072655","resolution":{"observed_at":"2026-05-19T01:06:57.382182Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2509.17676","last_updated":"2026-04-18T21:16:15Z","snapshot_observed_at":"2026-07-06T22:30:26.679189Z","submitted_at":"2025-09-22T12:19:46Z","title":"GLo-MAPPO: Multi-Agent Deep Reinforcement Learning for Energy-Efficient UAV-Assisted LoRa Networks","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-18T14:58:06.782237Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2509.17676"},"observation_digest":"sha256:f52b036a088544eb34763d1d29b400c85e21995c1ad21d705d81b2a637cbae6f","observation_id":"5c2ab09e-d822-4490-9eb9-f8159364714b","resolution":{"observed_at":"2026-05-18T15:01:32.085928Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-04T00:21:00.300581Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2511.02304","last_updated":"2026-06-01T21:37:50Z","snapshot_observed_at":"2026-08-04T00:20:58.682125Z","submitted_at":"2025-11-04T06:37:36Z","title":"Automata-Conditioned Cooperative Multi-Agent Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T00:21:00.300581Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2511.02304"},"observation_digest":"sha256:062ff00abb6612331bee483d7254eb8baf2b915225aeed745f0cfc6c23703b1f","observation_id":"5f4b886c-90d3-46f5-a56e-cb66cfc3f0d8","resolution":{"observed_at":"2026-08-04T00:21:00.300581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-03T22:45:05.341279Z","title":"Is independent learning all you need in the starcraft multi-agent challenge?","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2511.09331","last_updated":"2026-07-11T16:56:25Z","snapshot_observed_at":"2026-08-03T22:45:04.017907Z","submitted_at":"2025-11-12T13:46:27Z","title":"CoRL-MPPI: Enhancing MPPI With Learnable Behaviours For Efficient And Provably-Safe Multi-Robot Collision Avoidance","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T22:45:05.341279Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2511.09331"},"observation_digest":"sha256:22307de694a29182e82268a947bd9c6cd16f2f109efc62d749f2daf16ed8a7e6","observation_id":"6615f35e-7150-4c6a-9042-b68e5943707f","resolution":{"observed_at":"2026-08-03T22:45:05.341279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2601.21972","last_updated":"2026-05-26T15:41:11Z","snapshot_observed_at":"2026-08-03T06:46:35.623443Z","submitted_at":"2026-01-29T16:50:30Z","title":"Learning Decentralized LLM Collaboration with Multi-Agent Actor Critic","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T09:47:47.051969Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2601.21972"},"observation_digest":"sha256:322027476e01af0e0684cfff853eef1f48f6d5cc13816133dd8211ff1dea4bc1","observation_id":"b6741e5a-2b25-4477-aa15-168156f3a141","resolution":{"observed_at":"2026-05-16T09:50:49.388973Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-03T06:46:38.714757Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2601.21972","last_updated":"2026-05-26T15:41:11Z","snapshot_observed_at":"2026-08-03T06:46:35.623443Z","submitted_at":"2026-01-29T16:50:30Z","title":"Learning Decentralized LLM Collaboration with Multi-Agent Actor Critic","version":5},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T06:46:38.714757Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2601.21972"},"observation_digest":"sha256:e4dda8c5292b44e57408552fc0bf59c6d405a12c5a91b8c5ff13963b2bb79968","observation_id":"24fd116b-8dd5-454b-8514-0d1b368a94c2","resolution":{"observed_at":"2026-08-03T06:46:38.714757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2602.01665","last_updated":"2026-05-27T04:20:45Z","snapshot_observed_at":"2026-08-03T05:37:34.993758Z","submitted_at":"2026-02-02T05:34:38Z","title":"TABX: A High-Throughput Sandbox Battle Simulator for Multi-Agent Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-25T07:41:48.634351Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2602.01665"},"observation_digest":"sha256:f1f5d4db5e0f394394f7f6f614af592875a2cb025c72529cf8c83abc9bf80a6f","observation_id":"b14eaffc-0966-4b5b-9580-29998a472d35","resolution":{"observed_at":"2026-05-25T07:45:29.811527Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-03T05:37:38.423388Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2602.01665","last_updated":"2026-05-27T04:20:45Z","snapshot_observed_at":"2026-08-03T05:37:34.993758Z","submitted_at":"2026-02-02T05:34:38Z","title":"TABX: A High-Throughput Sandbox Battle Simulator for Multi-Agent Reinforcement Learning","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T05:37:38.423388Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2602.01665"},"observation_digest":"sha256:fbc7c643ac3c73eb850b790be68cfd5ed2c4e6be0f0e4c42cd11f7e7fde5a5ce","observation_id":"83b20bd7-556a-4f4e-b745-9a534703513d","resolution":{"observed_at":"2026-08-03T05:37:38.423388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-02T22:04:22.549456Z","title":"Is independent learning all you need in the starcraft multi-agent challenge?arXiv preprint arXiv:2011.09533, 2020","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2602.18291","last_updated":"2026-06-10T06:44:26Z","snapshot_observed_at":"2026-08-02T22:04:15.861495Z","submitted_at":"2026-02-20T15:38:02Z","title":"Diffusing to Coordinate: Efficient Online Multi-Agent Diffusion Policies","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T22:04:22.549456Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2602.18291"},"observation_digest":"sha256:248bf1f7d1832df9a6afbe7e258725993d19ecab623043e39b27ee0fdac19b8f","observation_id":"b05aa95b-e6cf-4be0-823d-dde141e83ccf","resolution":{"observed_at":"2026-08-02T22:04:22.549456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2604.17220","last_updated":"2026-06-02T11:51:14Z","snapshot_observed_at":"2026-07-06T23:04:23.730478Z","submitted_at":"2026-04-19T03:03:25Z","title":"Dynamics of Cognitive Heterogeneity: Investigating Behavioral Biases in Multi-Stage Supply Chains with LLM-Based Simulation","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-10T06:06:48.422940Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2604.17220"},"observation_digest":"sha256:7e9e441b137175826303dccd76b6f2498883a8164084e29474bf5c0ce788404f","observation_id":"60db8146-90a8-4062-8d0a-46492b782f67","resolution":{"observed_at":"2026-05-10T06:11:20.592675Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2604.25972","last_updated":"2026-04-28T07:50:24Z","snapshot_observed_at":"2026-07-06T23:11:43.764239Z","submitted_at":"2026-04-28T07:50:24Z","title":"A Survey of Multi-Agent Deep Reinforcement Learning with Graph Neural Network-Based Communication","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-07T16:51:52.921851Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2604.25972"},"observation_digest":"sha256:1a0c86bc103995cb07ceac85f7f9fb94e1c2bb971bfcb3c7dfc769cf6d24add3","observation_id":"e038e97b-2a29-45bf-bc6e-7a28b318c74a","resolution":{"observed_at":"2026-05-11T23:31:15.706553Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.01865","last_updated":"2026-05-03T13:20:00Z","snapshot_observed_at":"2026-08-03T20:33:06.041689Z","submitted_at":"2026-05-03T13:20:00Z","title":"Quality-Aware Exploration Budget Allocation for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-08T19:35:39.458735Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.01865"},"observation_digest":"sha256:952066901ec25191afa069ce53f3185c14573e2474c63e4093bcbb49cff181f1","observation_id":"6c4fe843-9dfb-4b72-9bd5-19ac74c87580","resolution":{"observed_at":"2026-05-09T05:45:22.780858Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.02801","last_updated":"2026-05-04T16:42:18Z","snapshot_observed_at":"2026-07-06T23:15:51.008483Z","submitted_at":"2026-05-04T16:42:18Z","title":"Reinforcement Learning for LLM-based Multi-Agent Systems through Orchestration Traces","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T18:44:27.685266Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.02801"},"observation_digest":"sha256:aa3f7cf043b6961bfeb8b97106f89e667ffb61fc3e829e8111151dcada53dafd","observation_id":"4290e2d3-909c-4b6a-b7ed-e1870042122d","resolution":{"observed_at":"2026-05-09T06:15:37.820927Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.04345","last_updated":"2026-05-05T23:07:09Z","snapshot_observed_at":"2026-07-06T23:17:09.246351Z","submitted_at":"2026-05-05T23:07:09Z","title":"Structural Equivalence and Learning Dynamics in Delayed MARL","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-08T17:14:48.299305Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.04345"},"observation_digest":"sha256:aaa5ba93f8317847f91cea7af2c1bc0371a22db18efa7a6dcbb775230e463152","observation_id":"20c57cab-65df-4d84-8218-e63f0fbf767d","resolution":{"observed_at":"2026-05-11T17:46:07.709119Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.04741","last_updated":"2026-05-10T04:42:30Z","snapshot_observed_at":"2026-07-06T23:17:28.583202Z","submitted_at":"2026-05-06T10:37:41Z","title":"Hierarchical Multiagent Reinforcement Learning for Multi-Group Tax Game","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T16:11:38.561963Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.04741"},"observation_digest":"sha256:7d0b81bb57efbbc9bb7565eaac36ee856f3956c80eac6acc65730e2a916da32e","observation_id":"c38b668d-a53e-4f24-a17a-6a7b421a95c9","resolution":{"observed_at":"2026-05-11T18:21:09.388718Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.04741","last_updated":"2026-05-10T04:42:30Z","snapshot_observed_at":"2026-07-06T23:17:28.583202Z","submitted_at":"2026-05-06T10:37:41Z","title":"Hierarchical Multiagent Reinforcement Learning for Multi-Group Tax Game","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T01:54:01.596020Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.04741"},"observation_digest":"sha256:46fc06be95a1baa1844c07cd176dc5dfdda425c7dca1dfca0f27e9c2b690e9c8","observation_id":"75138870-8272-484a-9218-698e54175b46","resolution":{"observed_at":"2026-05-12T01:56:15.147649Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.06825","last_updated":"2026-05-07T18:27:15Z","snapshot_observed_at":"2026-07-06T23:19:15.382283Z","submitted_at":"2026-05-07T18:27:15Z","title":"Randomness is sometimes necessary for coordination","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-05-11T01:01:38.215613Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.06825"},"observation_digest":"sha256:36092ea3f81645cb8c27940fc51738dc4ee63003fc1555f513d110001c23320e","observation_id":"fc339639-4794-43a5-abd6-f2ba17a25203","resolution":{"observed_at":"2026-05-11T04:50:57.900648Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.08391","last_updated":"2026-05-19T01:58:16Z","snapshot_observed_at":"2026-07-06T23:20:38.385189Z","submitted_at":"2026-05-08T19:00:34Z","title":"SACHI: Structured Agent Coordination via Holistic Information Integration in Multi-Agent Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T01:31:19.576223Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.08391"},"observation_digest":"sha256:d82fa1a234b0bf48f8ad8efb7f71d1471a6718947fec7e6bbb153fa99fe62aec","observation_id":"c634d3e0-8393-4da6-b01f-ec8b39e57407","resolution":{"observed_at":"2026-05-12T07:56:27.404219Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.08391","last_updated":"2026-05-19T01:58:16Z","snapshot_observed_at":"2026-07-06T23:20:38.385189Z","submitted_at":"2026-05-08T19:00:34Z","title":"SACHI: Structured Agent Coordination via Holistic Information Integration in Multi-Agent Reinforcement Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-20T22:34:46.440511Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.08391"},"observation_digest":"sha256:e41a80bad4ab912a603b6467c033504443f7e50b134e106c9abf95541c7fb51f","observation_id":"6de7d519-8b61-411f-84ff-47e02ec75580","resolution":{"observed_at":"2026-05-20T22:39:10.758260Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.09212","last_updated":"2026-05-09T23:14:27Z","snapshot_observed_at":"2026-07-06T23:21:21.560069Z","submitted_at":"2026-05-09T23:14:27Z","title":"Rethinking Ratio-Based Trust Regions for Policy Optimization in Multi-Agent Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-12T03:56:28.447136Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.09212"},"observation_digest":"sha256:27675decb4a369074509818c8b10cc85fa4371e279e22b8e216811031d511999","observation_id":"84cb4efb-6fab-4b5b-a452-3716599bcc6f","resolution":{"observed_at":"2026-05-12T06:51:27.893046Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.10482","last_updated":"2026-05-12T07:11:47Z","snapshot_observed_at":"2026-08-02T13:35:48.840118Z","submitted_at":"2026-05-11T12:43:25Z","title":"Priority-Driven Control and Communication in Decentralized Multi-Agent Systems via Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-12T05:07:19.011782Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.10482"},"observation_digest":"sha256:06cf38dfec4f4b64a66e09ea712cdb70f268576ec1cafe99b61b019c94898103","observation_id":"e698a5a8-1cdf-4f2f-b70c-e82f62831d62","resolution":{"observed_at":"2026-05-12T05:36:26.498975Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.10482","last_updated":"2026-05-12T07:11:47Z","snapshot_observed_at":"2026-08-02T13:35:48.840118Z","submitted_at":"2026-05-11T12:43:25Z","title":"Priority-Driven Control and Communication in Decentralized Multi-Agent Systems via Reinforcement Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-13T03:27:04.676218Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.10482"},"observation_digest":"sha256:aa3566a96f143fb15384c5f06d3fac56ea16dfd19799b26772e732e7908a4439","observation_id":"a5ad4a25-8ea7-4128-80c7-4f3953a11455","resolution":{"observed_at":"2026-05-13T03:27:11.260747Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.11688","last_updated":"2026-05-12T07:46:03Z","snapshot_observed_at":"2026-07-31T18:15:17.654469Z","submitted_at":"2026-05-12T07:46:03Z","title":"Shaping Zero-Shot Coordination via State Blocking","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-13T07:42:23.260464Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.11688"},"observation_digest":"sha256:ff9bfc4cd12eb41c1f93bfcf7f3b33457148019599b5378ff561b151728ad718","observation_id":"a1ff86c5-aba8-4698-a5f5-b696f6578a49","resolution":{"observed_at":"2026-05-13T07:42:30.236738Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.12655","last_updated":"2026-06-10T15:03:44Z","snapshot_observed_at":"2026-07-06T23:24:18.302402Z","submitted_at":"2026-05-12T19:01:16Z","title":"Robust Instruction Compliance in Cooperative Multi-Agent Reinforcement Learning","version":3},"reference_index":136,"source":"arxiv_source","source_observed_at":"2026-06-30T22:11:35.277901Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.12655"},"observation_digest":"sha256:24e2c5f0edde88b6c1bf6a4677b8ac62658f62ba275f8b153055ec38fe541f84","observation_id":"f3a0ce6f-4c6b-4c7a-8d67-989fce7a2aa5","resolution":{"observed_at":"2026-06-30T22:15:05.787678Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.19235","last_updated":"2026-05-19T01:07:39Z","snapshot_observed_at":"2026-08-03T12:43:59.750963Z","submitted_at":"2026-05-19T01:07:39Z","title":"GAE Falls Short in Imperfect-Information Self-Play Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-20T07:50:09.840762Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.19235"},"observation_digest":"sha256:a86dd7e568550cee20d22b8bbacd8e5aef123225d661ee7dcaeb5662fd7e2e07","observation_id":"47dda601-d95f-42e7-995d-3a8ec4c1a790","resolution":{"observed_at":"2026-05-20T07:53:10.038170Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.20255","last_updated":"2026-05-25T19:49:33Z","snapshot_observed_at":"2026-07-31T01:34:30.871692Z","submitted_at":"2026-05-18T12:02:41Z","title":"Multi-Agent Reinforcement Learning for Safe Autonomous Driving Under Pedestrian Behavioral Uncertainty","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-21T08:16:06.101467Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.20255"},"observation_digest":"sha256:dbd9b5fa1f22eac381d4609db3b1c998312b7118665b61449a906e707a2cebb9","observation_id":"d3c6a7a1-6985-41e2-873f-bc226bbff538","resolution":{"observed_at":"2026-05-21T08:19:52.576414Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.20255","last_updated":"2026-05-25T19:49:33Z","snapshot_observed_at":"2026-07-31T01:34:30.871692Z","submitted_at":"2026-05-18T12:02:41Z","title":"Multi-Agent Reinforcement Learning for Safe Autonomous Driving Under Pedestrian Behavioral Uncertainty","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T18:41:15.177901Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.20255"},"observation_digest":"sha256:5985f76b2d88d89189b38b846b0faaf7180112d802b6281a4cc06853ffe8c3d2","observation_id":"e3754cdb-3ace-4344-8be2-5eb1a42be905","resolution":{"observed_at":"2026-06-30T18:45:00.623817Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.23562","last_updated":"2026-05-22T12:29:29Z","snapshot_observed_at":"2026-07-06T23:33:44.335185Z","submitted_at":"2026-05-22T12:29:29Z","title":"ARMS: Automatic Reward Shaping for Sparse-Reward Multi-Agent Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-25T02:45:23.162374Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.23562"},"observation_digest":"sha256:92a50f8bd4c9df701a43e57e4101bb094dfbfca995e6e2f83b8eceb7a547da89","observation_id":"83b36f02-d62c-4f55-8c06-2ed93933cb6c","resolution":{"observed_at":"2026-05-25T02:46:33.540674Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2605.23652","last_updated":"2026-05-22T14:04:43Z","snapshot_observed_at":"2026-08-02T06:13:06.501853Z","submitted_at":"2026-05-22T14:04:43Z","title":"One Policy, Infinite NPCs: Persona-Traceable Shared RL Policies for Scalable Game Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-25T04:08:01.237797Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2605.23652"},"observation_digest":"sha256:e284d1b84c34050e76c2f291c0bfa24a3f437ae18d406d9415441d6e9428a02d","observation_id":"add93690-0dcf-4584-90f2-b6e882e146c9","resolution":{"observed_at":"2026-05-25T04:10:19.524254Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-07-31T22:58:06.517022Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:eaa60d70411848f93177290a72535d4d8d069abfdd5af2031a729a99c1a8d84d","observation_id":"25717b9d-3024-4e1f-be48-7c30eb504949","resolution":{"observed_at":"2026-07-02T22:07:25.850015Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2606.09958","last_updated":"2026-06-08T12:04:06Z","snapshot_observed_at":"2026-07-06T23:49:12.754871Z","submitted_at":"2026-06-08T12:04:06Z","title":"Uncertainty-Aware Motion Planning for Autonomous Driving in Mixed Traffic Environment","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T16:20:28.917237Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2606.09958"},"observation_digest":"sha256:a86ccb6689ba48380f2beb7ee9b151e467e1237fd8a5b765e525be78ab5c0f77","observation_id":"adc1b065-e8ad-42f1-a495-a8b85f0b62f7","resolution":{"observed_at":"2026-07-03T01:47:31.271184Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2606.13076","last_updated":"2026-06-11T08:59:41Z","snapshot_observed_at":"2026-08-01T07:46:46.244578Z","submitted_at":"2026-06-11T08:59:41Z","title":"$\\alpha$-fair heterogeneous agent reinforcement learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-27T05:15:10.298871Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2606.13076"},"observation_digest":"sha256:09f7be342f2c1aed6e24d17de4febc4a395e1cd9fb0a61330734cd2af1b480d9","observation_id":"f258d79e-a570-4c29-b562-06bafb526b94","resolution":{"observed_at":"2026-06-27T05:20:35.875559Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-13T07:38:02.368884Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2606.14130","last_updated":"2026-07-09T21:57:35Z","snapshot_observed_at":"2026-08-02T18:55:27.277790Z","submitted_at":"2026-06-12T05:30:53Z","title":"Contract-Based Compositional Shielding for Safe Multi-Agent Reinforcement Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T07:38:02.368884Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2606.14130"},"observation_digest":"sha256:2840aed5f9ed6a3bdded8ec3e3dd19c7a11d93e484f333e2293e429966416d46","observation_id":"0b2e67d2-63d4-4938-9fee-6a1bfda13a8b","resolution":{"observed_at":"2026-07-13T07:38:02.368884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2606.25526","last_updated":"2026-06-24T08:05:11Z","snapshot_observed_at":"2026-08-02T01:57:59.936036Z","submitted_at":"2026-06-24T08:05:11Z","title":"Low Variance Trust Region Optimization with Independent Actors and Sequential Updates in Cooperative Multi-agent Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-25T21:17:28.832301Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2606.25526"},"observation_digest":"sha256:86313c2d8a2333d005c4f56ec759449af653f692ba02680fdec34a0c41094b23","observation_id":"ef5355c4-7fd3-44a2-91fb-08055c8b5910","resolution":{"observed_at":"2026-07-04T19:30:07.596579Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2606.29126","last_updated":"2026-07-01T12:24:28Z","snapshot_observed_at":"2026-07-07T00:03:07.870153Z","submitted_at":"2026-06-28T00:29:12Z","title":"HiComm: Hierarchical Communication for Multi-agent Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T07:58:50.823587Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2606.29126"},"observation_digest":"sha256:87a7b9937fbe8b28ef9b8d9d036d34f1138c3bb4c61e2c2fc46cc59a66cb36d0","observation_id":"347de482-8002-400c-83e8-a35140fdc7c7","resolution":{"observed_at":"2026-06-30T08:04:28.210847Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2606.29126","last_updated":"2026-07-01T12:24:28Z","snapshot_observed_at":"2026-07-07T00:03:07.870153Z","submitted_at":"2026-06-28T00:29:12Z","title":"HiComm: Hierarchical Communication for Multi-agent Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-02T20:54:45.339382Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2606.29126"},"observation_digest":"sha256:669f0b43f1ba17330e364dea396d8753b7cbbdad2aca07cd832f637e05a5baf4","observation_id":"2d7aaac3-d058-4123-9638-4b946932fc9f","resolution":{"observed_at":"2026-07-02T20:57:22.693570Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":null,"work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2607.00324","last_updated":"2026-07-01T01:50:04Z","snapshot_observed_at":"2026-08-02T03:28:21.612925Z","submitted_at":"2026-07-01T01:50:04Z","title":"Queue-Aware Graph Reinforcement Learning for UAV-ISAC-Assisted Maritime Data Collection","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-02T00:50:38.051501Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2607.00324"},"observation_digest":"sha256:e481c57cf86fb9a03622f68bf04bc97b23a5671d3ee69e54299982369938404a","observation_id":"cfec2997-ff53-495a-abba-cdb0ea09d976","resolution":{"observed_at":"2026-07-02T00:56:24.158913Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Is independent learning all you need in the starcraft multi-agent challenge? arXiv preprint arXiv:2011.09533, 2020","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:dcfe59fc48a2f495a193a8fafbd0ee5d0dc61991a27a3b03adfff8119599cd85","observation_id":"779a09df-d05f-4cf1-a990-836252a614ad","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-02T04:50:33.029683Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.13591","last_updated":"2026-07-15T08:32:40Z","snapshot_observed_at":"2026-08-02T04:50:27.651928Z","submitted_at":"2026-07-15T08:32:40Z","title":"Memory as a Controlled Process: Learned Adaptive Memory Management for LLM Agents","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T04:50:33.029683Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2607.13591"},"observation_digest":"sha256:a83ceaef91db84a1f3da790bc6ea7d2c33432b0e9ffffb90b525db78c07cd289","observation_id":"4c22faf1-3755-4a3d-93d9-02b132b4cc65","resolution":{"observed_at":"2026-08-02T04:50:33.029683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-01T16:42:02.462350Z","title":"Is independent learning all you need in the starcraft multi-agent challenge?arXiv preprint arXiv:2011.09533,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.17924","last_updated":"2026-07-20T13:20:29Z","snapshot_observed_at":"2026-08-01T16:42:01.188011Z","submitted_at":"2026-07-20T13:20:29Z","title":"Aggregate in the Advantage, Not the Ratio: A Canonical-Form Analysis of Cooperative Multi-Agent Policy Optimization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T16:42:02.462350Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2607.17924"},"observation_digest":"sha256:fc457d79d0168bc4b236b3e66f56eab73d5e33e4d8ce4616e585aacd2cf21661","observation_id":"dfb80bfe-04ff-4c44-bc48-6d234cb14935","resolution":{"observed_at":"2026-08-01T16:42:02.462350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-01T11:44:45.826996Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.19809","last_updated":"2026-07-22T06:42:03Z","snapshot_observed_at":"2026-08-02T19:11:38.454861Z","submitted_at":"2026-07-22T06:42:03Z","title":"Dreamer-CPC: Message Learning with World Models for Decentralized Multi-agent Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T11:44:45.826996Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2607.19809"},"observation_digest":"sha256:7b8fe78fd3ccba70b783fe3b758a0678f89ff549e00d853723128ff07b88e6b6","observation_id":"bd66d22c-d191-46c2-ada4-64c274546c7d","resolution":{"observed_at":"2026-08-01T11:44:45.826996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2011.09533/citation-record","integrity":"/paper/2011.09533/integrity","json":"/paper/2011.09533/citation-record.json","paper":"/paper/2011.09533"},"outbound":[],"paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-01T17:34:34.583507Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 42 inbound Pith citation observations for arXiv:2011.09533."}