{"as_of":"2026-08-09T16:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a8f6214f9afb7f7fd350c4ac885a2d5eb4a1613ef5f0543c6a0bb3b0c35ae2e2","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T16:19:57.385629Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-21T20:40:13.721163Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T20:40:35.732465Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2502.06261","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06261","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qiuming Zhu","venue":null,"work_id":"a28d140e-e8e7-4fbd-8619-60ab16b84bde","year":null},"citing_paper":{"arxiv_id":"2510.07799","last_updated":"2026-05-16T23:46:00Z","snapshot_observed_at":"2026-07-06T22:32:07.945004Z","submitted_at":"2025-10-09T05:28:28Z","title":"Dynamic Generation of Multi-LLM Agents Communication Topologies with Graph Diffusion Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-21T20:40:13.721163Z"},"links":{"cited_paper":"/paper/2502.06261","citing_paper":"/paper/2510.07799"},"observation_digest":"sha256:ef17a2fca346e3d0af55d740a2b740e95222d67d983d559ed0279334a0cb6d14","observation_id":"43643e14-e495-41d7-b4f5-2f0fd331414b","resolution":{"observed_at":"2026-05-21T20:40:35.734281Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.06261/citation-record","integrity":"/paper/2502.06261/integrity","json":"/paper/2502.06261/citation-record.json","paper":"/paper/2502.06261"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1610.03295","last_updated":"2016-10-11T12:09:03Z","snapshot_observed_at":"2026-08-03T05:49:14.071341Z","submitted_at":"2016-10-11T12:09:03Z","title":"Safe, Multi-Agent, Reinforcement Learning for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.03295","snapshot_observed_at":"2026-08-08T16:19:57.231120Z","title":"Safe, multi-agent, reinforcement learning for autonomous driving","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.231120Z"},"links":{"cited_paper":"/paper/1610.03295","citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:6d42be67c0f813e2b5f6f701a6850605c5e012d81cb0aea1ca0f99ae733b7313","observation_id":"2502d351-1eec-4dd7-ad7d-9c2cb6102b59","resolution":{"observed_at":"2026-08-08T16:19:57.231120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.938032Z","title":"Andrew Bagnell, and Jan Peters","venue":null,"work_id":"c8670e53-7ab8-47c3-ab26-da147f1d5971","year":2013},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.235827Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:5f3c2cb72efd81c9d70feed1d928677bb36a475d91aa44a14a9b8339f2725676","observation_id":"2c1d2711-1abc-47b8-b82c-8db6fcc4c381","resolution":{"observed_at":"2026-08-08T16:19:57.942225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.926498Z","title":"Lillicrap, Fan Hui, Laurent Sifre, George van den Driessche, Thore Graepel, and Demis Hassabis","venue":null,"work_id":"f10f477d-8b08-44a7-87e9-0b74a391182f","year":2017},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.239709Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:d76ec0d9ce5f62f83c4801260560352ac72c2a073c5d8b613db6650025ba0c75","observation_id":"e9906b90-5667-40d2-9ccc-d79ac42f6c43","resolution":{"observed_at":"2026-08-08T16:19:57.930455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.243916Z","title":"Superhuman ai for multiplayer poker","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.243916Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:3453564a23e07e3de73c956707203c59c102c9e9632faec6f7ed640d0a82d281","observation_id":"260c663c-9d33-4732-b418-d6c540395658","resolution":{"observed_at":"2026-08-08T16:19:57.243916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.908048Z","title":"Multi-agent deep reinforcement learning: a survey","venue":null,"work_id":"73ddf35d-dc24-4fb9-bd39-a4fcc580a61a","year":2022},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.247910Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:f79cb0696a69289f671c72bf6a3196ba739de68120d0a7bed1ee4fba5a200428","observation_id":"0ed4485b-0a8b-4973-904a-848343e7039f","resolution":{"observed_at":"2026-08-08T16:19:57.912218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.896902Z","title":"A review of cooperative multi-agent deep reinforcement learning","venue":null,"work_id":"fb8a0028-06f4-4e93-8fff-d58497636c04","year":2023},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.252110Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:8c2dab6c9d191cd91c4fbe6a30bc6df5f90c41a98b1b658be3c238785dcec463","observation_id":"44ff44a0-b69d-46c1-8593-53e56d53de4d","resolution":{"observed_at":"2026-08-08T16:19:57.900717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.00583","last_updated":"2025-08-13T17:31:43Z","snapshot_observed_at":"2026-08-07T03:34:27.861455Z","submitted_at":"2020-11-01T18:24:40Z","title":"Game-Theoretic Multiagent Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.00583","snapshot_observed_at":"2026-08-08T16:19:57.256137Z","title":"An overview of multi-agent reinforcement learning from game theoretical perspective","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.256137Z"},"links":{"cited_paper":"/paper/2011.00583","citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:c9b2b5dc63a5e1c4da1cc47937e4441863d7f385205ddd63b689877ceac4510c","observation_id":"c621892d-1268-4738-8b97-d31465cd2da1","resolution":{"observed_at":"2026-08-08T16:19:57.256137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.885386Z","title":"A survey of multi-agent deep reinforcement learning with communication","venue":null,"work_id":"3a59d6fe-b3e0-4954-96d8-6af42a904739","year":2024},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.260307Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:9f3e3ab4e63b15647209403aec3ae011f77876623044ea71cfdd2724a555fe0f","observation_id":"53d58494-54f7-40e7-b050-f2caec36681b","resolution":{"observed_at":"2026-08-08T16:19:57.890024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.05438","last_updated":"2019-11-13T13:08:46Z","snapshot_observed_at":"2026-08-06T07:40:06.252391Z","submitted_at":"2019-11-13T13:08:46Z","title":"Learning to Communicate in Multi-Agent Reinforcement Learning : A Review","version":1},"cited_work":{"arxiv_id":"1911.05438","doi":null,"metadata_source":"pith","pith_arxiv_id":"1911.05438","snapshot_observed_at":"2026-08-08T16:19:57.443200Z","title":"Learning to Communicate in Multi-Agent Reinforcement Learning : A Review","venue":"cs.LG","work_id":"649a9278-4938-479e-af4b-c9b2af39e6a1","year":2019},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.263808Z"},"links":{"cited_paper":"/paper/1911.05438","citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:2f3d36cc086e601d2bbb4c9aeca4c1c486cd0c362657066a9ba8c9c294f28b33","observation_id":"63863f1c-7dbe-4ae1-80ed-7c8c1efad291","resolution":{"observed_at":"2026-08-08T16:19:57.447875Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.873220Z","title":"Synchronizing UA V teams for timely data collection and energy transfer by deep reinforcement learning.IEEE Trans","venue":null,"work_id":"9d707e54-e069-4ae1-ab6d-90ee46c776c3","year":2022},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.268322Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:5c6a5838d5587995de0e2e71d37dc046429883d469bdcfa9816b95284b0ce691","observation_id":"1fa22990-4611-4c4e-93ae-e3fc907cf14a","resolution":{"observed_at":"2026-08-08T16:19:57.877265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.861025Z","title":"Gupta, Maxim Egorov, and Mykel J","venue":null,"work_id":"e5343e2b-ea08-414f-ab86-dae0b13e6dde","year":2017},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.272017Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:6534f3c6ced5d9e73efc0d6d411622fcfd4634c124b83256533c18a31b2a5083","observation_id":"e2af9672-e080-4e8c-a6d4-cf4f554dec2e","resolution":{"observed_at":"2026-08-08T16:19:57.865314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.848872Z","title":"Actor-attention-critic for multi-agent reinforcement learning","venue":null,"work_id":"49a088a7-be84-4abe-af42-7db53e68965c","year":2019},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.275766Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:be2a77267466d0281e9b981cf63a3d7a98355a9d7ecf3b1e64184b6454ac3dcd","observation_id":"76cdcfb3-9d57-40fe-9989-19df94926e04","resolution":{"observed_at":"2026-08-08T16:19:57.852836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.836514Z","title":"Multi-agent game abstraction via graph attention neural network","venue":null,"work_id":"f64c559f-aa20-4d97-a7c5-c3503eade073","year":2020},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.279261Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:c996790b3d6988636c218e8466d8c43f35b68d41f889612cbdaa123a656a9935","observation_id":"d735ec4f-2ab2-4cac-b3e2-fd3f511285c5","resolution":{"observed_at":"2026-08-08T16:19:57.841082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.823780Z","title":"Foerster, Yannis M","venue":null,"work_id":"920b91bc-947c-4aef-9c7b-69545f63535e","year":2016},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.282882Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:c8dd8ef909252c9e5021bd270eb4ba4cc47273414c615efad9659c5cc8c071d7","observation_id":"50ad4426-d549-4411-95f0-7ab54952edad","resolution":{"observed_at":"2026-08-08T16:19:57.828059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.811037Z","title":"Learning attentional communication for multi-agent cooperation","venue":null,"work_id":"3811ac10-aea4-4256-91cb-c70375c2e44f","year":2018},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.286367Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:4277959b7133b4b01e11244d16fe3b8c81528f802ce6b1de79dbee2aa457dc60","observation_id":"4d8280e2-0c10-4867-9da6-8745ea8aaa57","resolution":{"observed_at":"2026-08-08T16:19:57.815218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.798886Z","title":"On centralized critics in multi-agent reinforcement learning","venue":null,"work_id":"86004a76-decd-4284-89a1-c5be92e4fb11","year":2023},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.290029Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:f3468e956b636f0cb46244448b6dcf3d34cc4a3e3d1e37ea1d2dc9591227cafb","observation_id":"4cd0f890-75f4-47d0-807d-7ef2abc8efde","resolution":{"observed_at":"2026-08-08T16:19:57.803138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.785593Z","title":"Contrasting centralized and decentralized critics in multi-agent reinforcement learning","venue":null,"work_id":"005b2db4-a49a-425d-ba04-b8ecc44f3743","year":2021},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.293752Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:25243cfc5aa1fb418b364b3412e7710402c1ee3fe7369484e9bb46dc657516c5","observation_id":"ab5ac30a-7032-499c-a7fa-4c129a7727a2","resolution":{"observed_at":"2026-08-08T16:19:57.790276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.773310Z","title":null,"venue":null,"work_id":"f9ce7629-6569-4a20-adec-622945c381a7","year":2019},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.297561Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:dfda17f14e47e5c234e7e97e1bdc2470915f16323d85bc2dca8ef78b1fd34318","observation_id":"e2acd4fc-4eb2-4ef4-beba-78cad4a5ecc8","resolution":{"observed_at":"2026-08-08T16:19:57.777375Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.760264Z","title":"Learning when to communicate at scale in multiagent cooperative and competitive tasks","venue":null,"work_id":"b34a02e4-ecc8-4353-8293-67daeec8f819","year":2019},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.301076Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:786e9c5da87561c78acd91bfb69654dbfb0c102f92f389816dd7d32ce5eef50f","observation_id":"29b1d46d-b70b-4eda-8a75-ac8e11450dd9","resolution":{"observed_at":"2026-08-08T16:19:57.764455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.747522Z","title":"Learning nearly decomposable value functions via communication minimization","venue":null,"work_id":"8fe8a5fe-72d1-4b9d-9645-ddd1cb2252e1","year":2020},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.304345Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:48d3dae852e369c36c39769d59994c16df8ed67ba9a3c1694055a9285be848e0","observation_id":"b1cd5816-7b13-4b7c-9501-07fd00af2ed0","resolution":{"observed_at":"2026-08-08T16:19:57.752061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.735157Z","title":"Tarmac: Targeted multi-agent communication","venue":null,"work_id":"309e11cf-e143-4323-9b22-db6721b3a0fd","year":2019},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.308063Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:373170a7cc0e78d2fbb4326d12dc8a22b7d86d5d752b9c97e140bcb15d3f4e07","observation_id":"5399a4ea-c558-4750-9256-e3608063321b","resolution":{"observed_at":"2026-08-08T16:19:57.739756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.722380Z","title":"Succinct and robust multi-agent communication with temporal message control","venue":null,"work_id":"78d9150b-a561-48a0-9be8-3cbabc8696c9","year":2020},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.311448Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:682f0a79dc9e96fce62d4c342437d10e002c3911e898b02d35b09dd53dde31ee","observation_id":"f486a015-d6a9-4425-941b-47cc06b575ac","resolution":{"observed_at":"2026-08-08T16:19:57.727281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.709523Z","title":"Multi-agent incentive communication via decentralized teammate modeling","venue":null,"work_id":"c72f3cb8-e557-4f09-823b-9a0077bcb7bb","year":2022},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.315048Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:cfc756faa23062502c8b0ad4daeeb26e5b849cb77445ad0054a2671422dfa17a","observation_id":"47371f0b-3f35-4051-bba6-955baeb63263","resolution":{"observed_at":"2026-08-08T16:19:57.714440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.09605","last_updated":"2023-02-19T16:02:16Z","snapshot_observed_at":"2026-08-05T08:35:11.560283Z","submitted_at":"2023-02-19T16:02:16Z","title":"Efficient Communication via Self-supervised Information Aggregation for Online and Offline Multi-agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2302.09605","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.09605","snapshot_observed_at":"2026-08-08T16:19:57.422317Z","title":"Efficient Communication via Self-supervised Information Aggregation for Online and Offline Multi-agent Reinforcement Learning","venue":"cs.LG","work_id":"a7c8a104-f327-468b-aea5-73e742543982","year":2023},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.318308Z"},"links":{"cited_paper":"/paper/2302.09605","citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:fa132830e7c3eed91f6509e6036300122db0faef184e0ca09ca6f05c16cd49af","observation_id":"dc851daa-5e93-4f43-b34f-898263b0d19a","resolution":{"observed_at":"2026-08-08T16:19:57.429389Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.696806Z","title":"T2MAC: targeted and trusted multi-agent communication through selective engagement and evidence-driven integration","venue":null,"work_id":"6e9a0668-879f-4a6c-84f9-f39bd29e4658","year":2024},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.321950Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:2c3dcba9b8345bd6743aa40900d47dc2c6029a1a68613205a42f96b2af1aa310","observation_id":"d663d7fd-eb8a-462a-ae88-75fa11f7a47a","resolution":{"observed_at":"2026-08-08T16:19:57.702005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.684529Z","title":"Learning agent communication under limited bandwidth by message pruning","venue":null,"work_id":"f38031fd-2b5e-41f7-a698-37fe77a66b49","year":2020},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.325582Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:14eabd402e2362c1115c3f7835ce2868b6a61afb15f40312b5a5d0c080113320","observation_id":"f8ef8820-5f49-4e12-8642-0d8229b43d46","resolution":{"observed_at":"2026-08-08T16:19:57.689369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.671449Z","title":"Learning individually inferred communication for multi-agent cooperation","venue":null,"work_id":"07cab71e-6309-4158-8c46-0e4c198b15fc","year":2020},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.329291Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:5fbe797bec97e50f36cf34879d268f4512a9d635e806ec453c00ad3b628ebb0e","observation_id":"e9d26ae2-e5db-4c43-8407-b819ba851ea4","resolution":{"observed_at":"2026-08-08T16:19:57.676710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.659367Z","title":"Scalable communication for multi-agent reinforcement learning via transformer-based email mechanism","venue":null,"work_id":"4c48774e-a509-4169-a8b3-8f2d2874dfb9","year":2023},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.333133Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:7d46ae29de885258eef4e6a3b5038090fa5d36baca0acbeb8fd6a97ee65d6da4","observation_id":"1daecf9d-87cd-4d6c-8e4b-26ab0c57e9cb","resolution":{"observed_at":"2026-08-08T16:19:57.663455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.647219Z","title":"Paleja, and Matthew C","venue":null,"work_id":"26d40c12-0d84-4053-a7e4-a46511d6cdc5","year":2021},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.336752Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:7a1a193ace484858d5f378dd6c9dde5b0300761645d63c32d9a5fb959c26f3b4","observation_id":"fdd81f46-af2f-4fc1-b09d-151fe47407e2","resolution":{"observed_at":"2026-08-08T16:19:57.651318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.634528Z","title":"Rgmcomm: Return gap minimization via discrete communications in multi-agent reinforcement learning","venue":null,"work_id":"ef48c1ee-51e9-40fc-a82d-efc942138ee9","year":2024},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.340540Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:4acccb92983dcb8fb19663fcb377a9bb970e4cbeb96d7f14a8adbefd39ac497b","observation_id":"28dcfc46-fc94-4beb-8b44-c963f933ecc4","resolution":{"observed_at":"2026-08-08T16:19:57.639216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.621550Z","title":"Learning efficient multi-agent communication: An information bottleneck approach","venue":null,"work_id":"6e97f81a-aa65-4782-95ab-36933db0eedb","year":2020},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.344297Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:57d9cded0c619600590752a7d74832956997a5ec9dfc6cd7ef9003b14a407ef6","observation_id":"ccd2a045-12b2-4663-ac85-ec7f84772e72","resolution":{"observed_at":"2026-08-08T16:19:57.626274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.608544Z","title":"Turner, Zoubin Ghahramani, and Sergey Levine","venue":null,"work_id":"4491f975-0513-47a7-8b18-4ebd710c72c7","year":2018},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.348020Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:cb32c0293824f8f63238e661d25e858d5e32ca645f30bb9d0ac028b5ee440496","observation_id":"36c00417-400e-47e1-8152-c691e2fc92a4","resolution":{"observed_at":"2026-08-08T16:19:57.613038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.595962Z","title":"Settling the variance of multi-agent policy gradients","venue":null,"work_id":"f4d9a274-e270-43bd-982a-515784369531","year":2021},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.351746Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:557bbffbea8713d02e6f3a258380f2dc7d21df6e52e2d3a43f27b7082eaa65ca","observation_id":"750508a3-0530-4fab-b6e2-b517d7b473bf","resolution":{"observed_at":"2026-08-08T16:19:57.600249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.583780Z","title":"Bayen, Sham M","venue":null,"work_id":"2b3898c8-09cd-424d-8509-6019817bf267","year":2018},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.355468Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:facc7bad09f8d68a22abd622aa0bc91a5d4396a1e538095a7e0f14059fd72b82","observation_id":"c6b2283d-fff9-476f-993c-66a066145f08","resolution":{"observed_at":"2026-08-08T16:19:57.588140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.571402Z","title":"Foerster, Gregory Farquhar, Triantafyllos Afouras, Nantas Nardelli, and Shimon Whiteson","venue":null,"work_id":"4fc1b006-4dd4-4e43-85ea-31528edaf300","year":2018},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.358946Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:1559a034dccc8651405ec7416ea73ec620a94a1180918775fa5044546e8dd792","observation_id":"8ce56dc4-6fcd-4ac0-93cd-dcaff29cba82","resolution":{"observed_at":"2026-08-08T16:19:57.575982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.559897Z","title":"Oliehoek and Christopher Amato","venue":null,"work_id":"9c0c8ff8-a0e3-4ef7-84ce-35518183b1d6","year":2016},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.362927Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:38ce6232ee3b9197716caf80663c79bd61ae5e22ab199ea80fc1a04dbfb88850","observation_id":"0a93dc96-7135-4326-9758-12a1ae8adbb9","resolution":{"observed_at":"2026-08-08T16:19:57.563650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.547241Z","title":"How, and John Vian","venue":null,"work_id":"0254c040-756d-4cac-a1a9-ad9e174f38b4","year":2017},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.366371Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:095c25bcaa3ffebfc47f57894a0ea49f7228ff845fbc73936b48187e70e69459","observation_id":"7d2499bd-7f49-4c4f-9b0a-e539f1638e5e","resolution":{"observed_at":"2026-08-08T16:19:57.551241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.533917Z","title":"Bayen, and Yi Wu","venue":null,"work_id":"70e2b1db-75e9-43fc-9e70-cecdde719944","year":2022},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.370035Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:37a561aeb319fbd5a600056a14d741346860ed58ca5bbc85a2ab63648882aa57","observation_id":"096520c6-2008-4126-8b19-96cc2861ea95","resolution":{"observed_at":"2026-08-08T16:19:57.539002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.521422Z","title":"Reinforcement learning with perturbed rewards","venue":null,"work_id":"81839bce-4b34-4805-b1c3-51f2580b44a6","year":2020},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.373921Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:8eff1a35a03f6844f852d16551eb94a1a93ee7abb17e9c7a9b090cb123bc50e8","observation_id":"3b6c0b15-b62e-4869-bb13-1a6c84b38299","resolution":{"observed_at":"2026-08-08T16:19:57.525368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.508106Z","title":"Boltzmann exploration done right","venue":null,"work_id":"6b7da13d-d15a-412b-add9-25220f536364","year":2017},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.378211Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:35fe7badc420a96c8163e1be692057e50d6e44ea99640bf0bf368e6537a6da41","observation_id":"efeccdbb-b43b-48f1-8ee1-e0d8329ab0a9","resolution":{"observed_at":"2026-08-08T16:19:57.512319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.495716Z","title":"Multi-agent reinforcement learning is a sequence modeling problem","venue":null,"work_id":"c3d30015-f949-4d35-a38d-9b3e6bda903f","year":2022},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.381817Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:af8ac20574088c9f248335da235c4be220a746f6d466dd6781a8e97c457caac8","observation_id":"8429745e-9246-47e2-a989-00b14c6caff1","resolution":{"observed_at":"2026-08-08T16:19:57.499808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:19:57.482448Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","venue":null,"work_id":"4be82428-4777-44f5-8e46-8d3cf7204ad5","year":2018},"citing_paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T16:19:57.385629Z"},"links":{"citing_paper":"/paper/2502.06261"},"observation_digest":"sha256:e13aa97345955153ec65b8b0d392641ffa4b1fa36462cc899a34639505d4e11d","observation_id":"e113d20f-d310-4260-8ff7-5ad4152560c3","resolution":{"observed_at":"2026-08-08T16:19:57.487352Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.06261","last_updated":"2025-02-10T08:53:13Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T17:02:10.798518Z","submitted_at":"2025-02-10T08:53:13Z","title":"Reducing Variance Caused by Communication in Decentralized Multi-agent Deep Reinforcement Learning"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":2,"verified_fuzzy":35},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2502.06261."}