{"as_of":"2026-08-21T07:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b1c580733f5c6ede8a1f09bc8c005702b24634ce1a085f0bf16a12c6b463bc00","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":28,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:06:35.898809Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":14,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-11T21:58:45.695716Z","title":"An introduction to centralized training for decentralized execution in cooperative multi-agent reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.03920","last_updated":"2025-07-20T01:35:50Z","snapshot_observed_at":"2026-08-17T14:59:50.479461Z","submitted_at":"2024-12-05T06:46:46Z","title":"A Survey on Large Language Model-Based Social Agents in Game-Theoretic Scenarios","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T21:58:45.695716Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2412.03920"},"observation_digest":"sha256:15b80f640b1239ff3f2df617dc6db1556e9c947ad2e7d2f4ecd5ed3f697ed0ff","observation_id":"782ae683-f35f-4269-8e58-665ee6edf90f","resolution":{"observed_at":"2026-08-11T21:58:45.695716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-08T18:50:49.747276Z","title":"An introduction to centralized training for decentralized execution in cooperative multi-agent reinforcement learning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05573","last_updated":"2025-02-08T13:57:53Z","snapshot_observed_at":"2026-08-13T23:46:59.161541Z","submitted_at":"2025-02-08T13:57:53Z","title":"Low-Rank Agent-Specific Adaptation (LoRASA) for Multi-Agent Policy Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-08T18:50:49.747276Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2502.05573"},"observation_digest":"sha256:c67cc88186206539b6707f28f5d360561e09f94253a4536cb09c88b5b77b87ae","observation_id":"75c72700-4ee4-4fc1-90df-51bcb9033149","resolution":{"observed_at":"2026-08-08T18:50:49.747276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-08T17:54:46.259862Z","title":"An introduction to centralized training for decentralized execution in cooperative multi-agent reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05812","last_updated":"2025-02-09T08:35:09Z","snapshot_observed_at":"2026-08-13T23:31:42.905194Z","submitted_at":"2025-02-09T08:35:09Z","title":"Multi-Agent Reinforcement Learning in Wireless Distributed Networks for 6G","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-08T17:54:46.259862Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2502.05812"},"observation_digest":"sha256:a0064966f8365c89ddd3e131de132fd8ad030a3ccd543e799653c35c94458404","observation_id":"89ca6b7a-aacf-4940-b807-c6b33978a579","resolution":{"observed_at":"2026-08-08T17:54:46.259862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-15T23:52:40.956366Z","title":"An introduction to centralized training for decentralized execution in cooperative multi-agent reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.03558","last_updated":"2025-05-06T14:11:21Z","snapshot_observed_at":"2026-08-19T14:53:18.411064Z","submitted_at":"2025-05-06T14:11:21Z","title":"Multi-Agent Reinforcement Learning Scheduling to Support Low Latency in Teleoperated Driving","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T23:52:40.956366Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2505.03558"},"observation_digest":"sha256:61edb6cf5658f9d17ccfbb0f79f755b6b8ef070523ff57f56797852998957a1a","observation_id":"a79c9291-51df-4bc2-8aea-f6f4abf8281d","resolution":{"observed_at":"2026-08-15T23:52:40.956366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-15T23:16:15.318064Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05108","last_updated":"2025-06-21T18:06:15Z","snapshot_observed_at":"2026-08-16T02:42:25.344531Z","submitted_at":"2025-05-08T10:13:53Z","title":"Multi-agent Embodied AI: Advances and Future Directions","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T23:16:15.318064Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2505.05108"},"observation_digest":"sha256:243ba8878c80e0d958bd0ecf82e60d41f315ae4cddd5d720e87c2cbe3e349e01","observation_id":"665d4dda-d0fc-450b-905f-a9f7bf7f5ceb","resolution":{"observed_at":"2026-08-15T23:16:15.318064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-15T22:34:11.213822Z","title":"An introduction to centralized training for decentralized execution in cooperative multi-agent reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.06997","last_updated":"2025-05-11T14:49:15Z","snapshot_observed_at":"2026-08-19T10:39:49.327986Z","submitted_at":"2025-05-11T14:49:15Z","title":"A Multi-Agent Reinforcement Learning Approach for Cooperative Air-Ground-Human Crowdsensing in Emergency Rescue","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T22:34:11.213822Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2505.06997"},"observation_digest":"sha256:78be86f9731fe153ae2097e098af2581327e84c89e49d86750bd3db93174b36b","observation_id":"14b5a24a-cb95-4c3c-9211-ae08216c2c98","resolution":{"observed_at":"2026-08-15T22:34:11.213822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2409.03052","doi":"10.48550/arxiv.2409.03052","metadata_source":"pith","pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An introduction to centralized training for decentralized execution in cooperative multi-agent reinforcement learning","venue":"cs.LG","work_id":"f490d83e-5af5-4df1-a209-43725a3eba07","year":2024},"citing_paper":{"arxiv_id":"2506.07548","last_updated":"2026-05-06T13:16:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-09T08:38:18Z","title":"Overcoming Environmental Meta-Stationarity in MARL via Adaptive Curriculum and Counterfactual Group Advantage","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-19T11:08:51.426575Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2506.07548"},"observation_digest":"sha256:a94754ab25257b1ec0051df30f4db8e3bc3dead67d39f6baf780c3288bc0ecc2","observation_id":"1099799c-3f0b-4b0c-9b86-453c0e31561f","resolution":{"observed_at":"2026-05-19T11:12:15.521735Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-15T18:05:58.333520Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19151","last_updated":"2025-08-02T01:01:16Z","snapshot_observed_at":"2026-08-19T08:34:28.885123Z","submitted_at":"2025-07-25T10:47:39Z","title":"ReCoDe: Reinforcement Learning-based Dynamic Constraint Design for Multi-Agent Coordination","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T18:05:58.333520Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2507.19151"},"observation_digest":"sha256:dbb5cbc4f522bb5a78098c8084c2adfe199803778b46ad83b99d6f2740107c3e","observation_id":"a2a49b79-ac74-41a4-9e13-1cc06653ec66","resolution":{"observed_at":"2026-08-15T18:05:58.333520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-06T10:40:38.686052Z","title":"An introduction to centralized training for decentralized execution in cooperative multi-agent reinforcement learning.arXiv preprint arXiv:2409.03052, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23604","last_updated":"2026-06-30T11:26:47Z","snapshot_observed_at":"2026-08-13T17:55:52.967098Z","submitted_at":"2025-07-31T14:42:12Z","title":"Hierarchical Message-Passing Policies for Multi-Agent Reinforcement Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T10:40:38.686052Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2507.23604"},"observation_digest":"sha256:69814b7135f61f1f5a0122279a91ebaa49cd66694f9f5f6fe842f6e1992da510","observation_id":"d8fa179c-fde7-4f44-b1b1-ab79d3212837","resolution":{"observed_at":"2026-08-06T10:40:38.686052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-05T10:37:10.405790Z","title":"Amato, An introduction to centralized training for decen- tralized execution in cooperative multi-agent reinforcement learning (2024), arXiv:2409.03052 [cs.LG]","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03974","last_updated":"2026-07-14T20:41:03Z","snapshot_observed_at":"2026-08-16T15:54:42.404581Z","submitted_at":"2025-09-04T08:01:22Z","title":"Real-time adaptive quantum error correction by model-free multi-agent learning","version":2},"reference_index":109,"source":"pdf_text","source_observed_at":"2026-08-05T10:37:10.405790Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2509.03974"},"observation_digest":"sha256:0feb45f8a9987b22dbb720a40439d9debd0031e52d2281ad1099499332e7feb8","observation_id":"44742ba5-51e9-4b7f-932b-1efb0f5ff205","resolution":{"observed_at":"2026-08-05T10:37:10.405790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-03T11:28:05.024515Z","title":", year 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.06485","last_updated":"2026-01-10T08:42:24Z","snapshot_observed_at":"2026-08-20T05:29:57.949760Z","submitted_at":"2026-01-10T08:42:24Z","title":"Coupling Smoothed Particle Hydrodynamics with Multi-Agent Deep Reinforcement Learning for Cooperative Control of Point Absorbers","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-03T11:28:05.024515Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2601.06485"},"observation_digest":"sha256:821b0c836dc7840d756d495cb8abb6ae1ce14ae93180cd51d79ade51bfcda8b1","observation_id":"dd073fbe-2a90-42f6-972e-65120b48f8ff","resolution":{"observed_at":"2026-08-03T11:28:05.024515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2409.03052","doi":"10.48550/arxiv.2409.03052","metadata_source":"pith","pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An introduction to centralized training for decentralized execution in cooperative multi-agent reinforcement learning","venue":"cs.LG","work_id":"f490d83e-5af5-4df1-a209-43725a3eba07","year":2024},"citing_paper":{"arxiv_id":"2603.12031","last_updated":"2026-05-07T16:33:01Z","snapshot_observed_at":"2026-08-14T16:39:12.942865Z","submitted_at":"2026-03-12T15:09:48Z","title":"AGMARL-DKS: An Adaptive Graph-Enhanced Multi-Agent Reinforcement Learning for Dynamic Kubernetes Scheduling","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-15T11:57:24.591538Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2603.12031"},"observation_digest":"sha256:77f6b9e71bf585a66c65bbf3a449bd1fccc0f50592f8b587c39c7e6a6997044d","observation_id":"eb300f35-c264-4348-8be0-7189985268ae","resolution":{"observed_at":"2026-05-15T11:59:59.397066Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2409.03052","doi":"10.48550/arxiv.2409.03052","metadata_source":"pith","pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An introduction to centralized training for decentralized execution in cooperative multi-agent reinforcement learning","venue":"cs.LG","work_id":"f490d83e-5af5-4df1-a209-43725a3eba07","year":2024},"citing_paper":{"arxiv_id":"2604.09028","last_updated":"2026-04-10T06:46:29Z","snapshot_observed_at":"2026-08-15T03:09:56.344194Z","submitted_at":"2026-04-10T06:46:29Z","title":"Plasticity-Enhanced Multi-Agent Mixture of Experts for Dynamic Objective Adaptation in UAVs-Assisted Emergency Communication Networks","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-10T16:55:19.978358Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2604.09028"},"observation_digest":"sha256:005c6d8a388c3b3031ec7e9682838b0e86575d73ef39b4502a57faf2e4c6877d","observation_id":"cb1ac08b-b1da-4f0b-a87a-c074f88c0bf8","resolution":{"observed_at":"2026-05-11T07:55:58.907161Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2409.03052","doi":"10.48550/arxiv.2409.03052","metadata_source":"pith","pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An introduction to centralized training for decentralized execution in cooperative multi-agent reinforcement learning","venue":"cs.LG","work_id":"f490d83e-5af5-4df1-a209-43725a3eba07","year":2024},"citing_paper":{"arxiv_id":"2604.17191","last_updated":"2026-04-19T01:40:39Z","snapshot_observed_at":"2026-08-15T08:33:13.141428Z","submitted_at":"2026-04-19T01:40:39Z","title":"Do LLM-derived graph priors improve multi-agent coordination?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T06:09:08.100187Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2604.17191"},"observation_digest":"sha256:5b38f30556de5262fa3da2521f4b47b5df11beebcf46af880d5fcf265c7ca783","observation_id":"f127e8cc-0c51-4bce-8faf-5cbd518ea800","resolution":{"observed_at":"2026-05-10T06:11:20.221104Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2409.03052","doi":"10.48550/arxiv.2409.03052","metadata_source":"pith","pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An introduction to centralized training for decentralized execution in cooperative multi-agent reinforcement learning","venue":"cs.LG","work_id":"f490d83e-5af5-4df1-a209-43725a3eba07","year":2024},"citing_paper":{"arxiv_id":"2605.06595","last_updated":"2026-05-07T17:20:34Z","snapshot_observed_at":"2026-08-16T09:11:48.635493Z","submitted_at":"2026-05-07T17:20:34Z","title":"Cross-Modal Navigation with Multi-Agent Reinforcement Learning","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-08T08:43:54.882467Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2605.06595"},"observation_digest":"sha256:101b434241b48ddab7a7cd182ff705921c6acb4eee7f63b0ea0b5bc880180672","observation_id":"48714f95-240c-41bd-9963-1c7687bce540","resolution":{"observed_at":"2026-05-11T20:31:12.757224Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2409.03052","doi":"10.48550/arxiv.2409.03052","metadata_source":"pith","pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An introduction to centralized training for decentralized execution in cooperative multi-agent reinforcement learning","venue":"cs.LG","work_id":"f490d83e-5af5-4df1-a209-43725a3eba07","year":2024},"citing_paper":{"arxiv_id":"2605.13131","last_updated":"2026-05-13T08:01:20Z","snapshot_observed_at":"2026-08-15T08:21:31.566036Z","submitted_at":"2026-05-13T08:01:20Z","title":"ERPPO: Entropy Regularization-based Proximal Policy Optimization","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-05-14T19:32:24.940497Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2605.13131"},"observation_digest":"sha256:2db859167f0a6fc7faa8c512aaf082c3e96b34c465481c9922687399ff792a82","observation_id":"630fcd5f-cbcd-4d5f-92f8-603fd71df216","resolution":{"observed_at":"2026-05-14T19:32:51.887848Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2409.03052","doi":"10.48550/arxiv.2409.03052","metadata_source":"pith","pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An introduction to centralized training for decentralized execution in cooperative multi-agent reinforcement learning","venue":"cs.LG","work_id":"f490d83e-5af5-4df1-a209-43725a3eba07","year":2024},"citing_paper":{"arxiv_id":"2605.14758","last_updated":"2026-05-14T12:22:54Z","snapshot_observed_at":"2026-08-12T21:36:06.672775Z","submitted_at":"2026-05-14T12:22:54Z","title":"Probabilistic Verification of Recurrent Neural Networks for Single and Multi-Agent Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T20:52:06.448213Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2605.14758"},"observation_digest":"sha256:fb88c5bda57e6e56944c04a3c5852ef0fb1f0796a74de9361035f1ebc7104d31","observation_id":"e0b1f735-c955-477c-9042-6794e1f3754a","resolution":{"observed_at":"2026-06-30T20:55:04.121723Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2409.03052","doi":"10.48550/arxiv.2409.03052","metadata_source":"pith","pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An introduction to centralized training for decentralized execution in cooperative multi-agent reinforcement learning","venue":"cs.LG","work_id":"f490d83e-5af5-4df1-a209-43725a3eba07","year":2024},"citing_paper":{"arxiv_id":"2605.15400","last_updated":"2026-05-14T20:34:16Z","snapshot_observed_at":"2026-08-16T09:25:27.791250Z","submitted_at":"2026-05-14T20:34:16Z","title":"Beyond Partner Diversity: An Influence-Based Team Steering Framework for Zero-Shot Human-Machine Teaming","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-19T15:27:22.127896Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2605.15400"},"observation_digest":"sha256:95ed526cf4b89b7f2495bfd256e12c8f1bdd3851282d92615caffe47864f6f6b","observation_id":"4bb3849e-ca0e-42b2-9395-bb96262f48b2","resolution":{"observed_at":"2026-05-19T15:27:38.614899Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2409.03052","doi":"10.48550/arxiv.2409.03052","metadata_source":"pith","pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An introduction to centralized training for decentralized execution in cooperative multi-agent reinforcement learning","venue":"cs.LG","work_id":"f490d83e-5af5-4df1-a209-43725a3eba07","year":2024},"citing_paper":{"arxiv_id":"2605.28764","last_updated":"2026-05-27T17:23:00Z","snapshot_observed_at":"2026-08-16T00:54:15.930425Z","submitted_at":"2026-05-27T17:23:00Z","title":"SwarmHarness: Skill-Based Task Routing via Decentralized Incentive-Aligned AI Agent Networks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-29T11:41:30.827427Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2605.28764"},"observation_digest":"sha256:ffb8609baa746e9ae1610916fb25ec2714d1accae351bc662b0fefefd375787e","observation_id":"7f4be0b3-7adb-41e8-ab15-2a685a9a60aa","resolution":{"observed_at":"2026-06-29T11:43:23.574722Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2409.03052","doi":"10.48550/arxiv.2409.03052","metadata_source":"pith","pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An introduction to centralized training for decentralized execution in cooperative multi-agent reinforcement learning","venue":"cs.LG","work_id":"f490d83e-5af5-4df1-a209-43725a3eba07","year":2024},"citing_paper":{"arxiv_id":"2606.12352","last_updated":"2026-06-10T17:26:08Z","snapshot_observed_at":"2026-08-05T23:26:56.240769Z","submitted_at":"2026-06-10T17:26:08Z","title":"CHORUS: Decentralized Multi-Embodiment Collaboration with One VLA Policy","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T09:55:03.745087Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2606.12352"},"observation_digest":"sha256:8541aa5e77cc9a3ccccb0e5284f1526e99fd7ac4ffd6267a686c339363984fd9","observation_id":"e61e9a24-c40b-4c47-b376-7d1b108638ee","resolution":{"observed_at":"2026-06-27T10:00:49.182519Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2409.03052","doi":"10.48550/arxiv.2409.03052","metadata_source":"pith","pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An introduction to centralized training for decentralized execution in cooperative multi-agent reinforcement learning","venue":"cs.LG","work_id":"f490d83e-5af5-4df1-a209-43725a3eba07","year":2024},"citing_paper":{"arxiv_id":"2606.18327","last_updated":"2026-06-16T17:59:40Z","snapshot_observed_at":"2026-08-17T01:42:14.296726Z","submitted_at":"2026-06-16T17:59:40Z","title":"Self-CTRL: Self-Consistency Training with Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T01:38:48.296421Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2606.18327"},"observation_digest":"sha256:1ab286969bff686428b3e0e7f632a410aed86f98e914f47474ae89db77bf3b7b","observation_id":"5c75ce09-454a-4ecf-8e76-0fb44705bfdc","resolution":{"observed_at":"2026-07-03T20:08:56.006777Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2409.03052","doi":"10.48550/arxiv.2409.03052","metadata_source":"pith","pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An introduction to centralized training for decentralized execution in cooperative multi-agent reinforcement learning","venue":"cs.LG","work_id":"f490d83e-5af5-4df1-a209-43725a3eba07","year":2024},"citing_paper":{"arxiv_id":"2607.06563","last_updated":"2026-07-07T17:59:44Z","snapshot_observed_at":"2026-08-14T16:15:41.312545Z","submitted_at":"2026-07-07T17:59:44Z","title":"Embodied Human-Robot Interaction via Acoustics: A MARL Approach with AcoustoBots for Spatial Data Physicalization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-08T01:42:38.113751Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2607.06563"},"observation_digest":"sha256:d7dc3ab32a083a3f052e14a79aeb12720b1b33edc63f2923b21c324efc454728","observation_id":"2fa175ba-26b1-47bc-8294-906142bf628d","resolution":{"observed_at":"2026-07-08T01:44:26.037734Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2409.03052","doi":"10.48550/arxiv.2409.03052","metadata_source":"pith","pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An introduction to centralized training for decentralized execution in cooperative multi-agent reinforcement learning","venue":"cs.LG","work_id":"f490d83e-5af5-4df1-a209-43725a3eba07","year":2024},"citing_paper":{"arxiv_id":"2607.07460","last_updated":"2026-07-08T14:28:10Z","snapshot_observed_at":"2026-08-18T00:14:26.199076Z","submitted_at":"2026-07-08T14:28:10Z","title":"Social-spatial dependencies for learning visual navigation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-07-09T10:23:00.725686Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2607.07460"},"observation_digest":"sha256:343bafa791ba4a570927da50db6910dfe457ec3ee9adeb65de77964a0822f99e","observation_id":"b6c0562f-ae7e-4f06-b25f-d52cc58b1241","resolution":{"observed_at":"2026-07-09T10:26:10.921508Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T11:18:56.949796+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-01T14:08:04.235006Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.18874","last_updated":"2026-07-21T09:06:23Z","snapshot_observed_at":"2026-08-18T19:50:51.354294Z","submitted_at":"2026-07-21T09:06:23Z","title":"Reinforcement Learning for Delivery Drone-Based Participatory Sensing in Dynamic Environments","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T14:08:04.235006Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2607.18874"},"observation_digest":"sha256:7f877d19cbeaaf4c065b62c5059e2f8b44371bf1eed49a699c2f8eb7aa13d9b0","observation_id":"02cff74d-13ab-47c2-a7df-cd902bf4b2d1","resolution":{"observed_at":"2026-08-01T14:08:04.235006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-15T14:52:00.844770Z","title":"An introduction to centralized training for decentralized execution in cooperative multi-agent reinforcement learn ing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03852","last_updated":"2026-08-04T15:56:32Z","snapshot_observed_at":"2026-08-20T05:40:23.942673Z","submitted_at":"2026-08-04T15:56:32Z","title":"FedCritic-MIMO: Communication-Efficient Serverless Federated Critic Learning for Massive-MIMO Resource Control in Open and Disaggregated 6G RANs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T14:52:00.844770Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2608.03852"},"observation_digest":"sha256:03c58babfa88894bbf7432956aef2feddb11acb3bd1cbbe227924e3a6638e9c1","observation_id":"c811c081-173a-4935-8d7f-0fccb6dc2993","resolution":{"observed_at":"2026-08-15T14:52:00.844770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-14T04:25:48.181291Z","title":"An introduction to centralized training for decentralized execution in cooperative multi-agent reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08895","last_updated":"2026-08-09T20:16:36Z","snapshot_observed_at":"2026-08-18T03:35:51.518169Z","submitted_at":"2026-08-09T20:16:36Z","title":"Latent Semantic State Estimation for Reliable Swarming of UAVs under Intermittent Connectivity","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T04:25:48.181291Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2608.08895"},"observation_digest":"sha256:6c646c6bca79da1e5369baf87b44dc96157749ebebe9a349ea302e846fca5a8f","observation_id":"252e686e-8d5a-4464-be9a-213793c6c3fa","resolution":{"observed_at":"2026-08-14T04:25:48.181291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-11T11:20:20.055396Z","title":"An introduction to centralized training for decentralized execution in cooperative multi-agent reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-16T17:37:23.023630Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:20.055396Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:3fd54db570ec56aeef012eb781514abd5e9dcdb434c3647b7625483d6186c4d5","observation_id":"5074cb71-2bf8-4341-9c92-132d71c9fe2e","resolution":{"observed_at":"2026-08-11T11:20:20.055396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-16T00:06:35.898809Z","title":"arXiv preprint arXiv:2409.03052 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.12753","last_updated":"2026-08-13T03:06:11Z","snapshot_observed_at":"2026-08-20T04:57:13.784858Z","submitted_at":"2026-08-13T03:06:11Z","title":"Decentralized Multi-Player Q-Learning in Episodic Markov Decision Processes with Information Asymmetry","version":1},"reference_index":149,"source":"arxiv_source","source_observed_at":"2026-08-16T00:06:35.898809Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2608.12753"},"observation_digest":"sha256:cd90e51d0bab86c064cd309704ac4528b8c0d039615b0559ad04dba61b96ed2f","observation_id":"afa5d363-c047-481b-9121-1601d3146f91","resolution":{"observed_at":"2026-08-16T00:06:35.898809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2409.03052/citation-record","integrity":"/paper/2409.03052/integrity","json":"/paper/2409.03052/citation-record.json","paper":"/paper/2409.03052"},"outbound":[],"paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T13:21:17.211013Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 28 inbound Pith citation observations for arXiv:2409.03052."}