{"as_of":"2026-08-18T08:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8ca021c584aa70d5c1f5240597610c1ca934e7431f13cc8f25b2add8edb8178e","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:16:13.519936Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.10484/citation-record","integrity":"/paper/2505.10484/integrity","json":"/paper/2505.10484/citation-record.json","paper":"/paper/2505.10484"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.286622Z","title":"Deep Reinforcement Learning at the Edge of the Statistical Precipice","venue":null,"work_id":"19c200e0-b39f-451b-ac86-709b10918600","year":2021},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.304741Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:94d0490cdd29318c10132653fb7161663733af06a510e401d5975521e51b9523","observation_id":"795d48fe-f43b-4ae2-a6f6-8b4e04b24bb9","resolution":{"observed_at":"2026-08-15T21:16:14.292619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.05789","last_updated":"2020-01-09T00:51:44Z","snapshot_observed_at":"2026-08-12T04:09:22.211968Z","submitted_at":"2019-10-13T17:17:52Z","title":"On the Utility of Learning about Humans for Human-AI Coordination","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.05789","snapshot_observed_at":"2026-08-15T21:16:13.310838Z","title":"Ho, Thomas L","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.310838Z"},"links":{"cited_paper":"/paper/1910.05789","citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:6e9d69f7ed224fb9ed052254b622b7566c61dd969ac3e8e17ca4c6a6560f3e87","observation_id":"9ed94a6c-c42a-44fc-898d-b98ee0219e9c","resolution":{"observed_at":"2026-08-15T21:16:13.310838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.316231Z","title":null,"venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.316231Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:8a0eb0b08ee52368aff29420f278e9996d4a904105666397ee68ce9f71991291","observation_id":"0cde20da-695e-4ed5-99cc-3ebcec5c571e","resolution":{"observed_at":"2026-08-15T21:16:13.316231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.07489","last_updated":"2023-10-17T14:05:58Z","snapshot_observed_at":"2026-08-16T16:08:35.587158Z","submitted_at":"2022-12-14T20:15:19Z","title":"SMACv2: An Improved Benchmark for Cooperative Multi-Agent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.07489","snapshot_observed_at":"2026-08-15T21:16:13.321615Z","title":"Foerster, and Shimon Whiteson","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.321615Z"},"links":{"cited_paper":"/paper/2212.07489","citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:7ee0034e593fcf4dfc63e0ad60329b75e8ab6ce1a0456f1fadc4002d17adb2f1","observation_id":"471b4d97-cece-4c7a-aad5-ae97236e3877","resolution":{"observed_at":"2026-08-15T21:16:13.321615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.326732Z","title":"Approximation capabilities of multilayer feedforward networks","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.326732Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:3c1637cb96a9514d44c1b1342e4a7cc8f6f00d3be51102dc9181b2ec25dda4cc","observation_id":"8d4a3314-cdd3-4200-bf96-edc85ff04ff2","resolution":{"observed_at":"2026-08-15T21:16:13.326732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.331537Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.331537Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:7001fbc4b6b5dacee158ce245f4794c505551477ff928cac085f755dab49d236","observation_id":"4ba6118e-b828-474c-9aaa-74110585d108","resolution":{"observed_at":"2026-08-15T21:16:13.331537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.259312Z","title":"On the Variance of the Adaptive Learning Rate and Beyond","venue":null,"work_id":"0b6a7924-230d-4ae0-bb68-4741e15906c3","year":2019},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.340955Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:b43fc0c6e9a200a0c2764439f263ddb995852995bf4a4ce1066956795f2992c5","observation_id":"74ef886b-23e9-4591-8023-4e4baf394119","resolution":{"observed_at":"2026-08-15T21:16:14.264736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.243083Z","title":"Multi-Agent Actor-Critic for Mixed Cooperative-Competitive Environments","venue":null,"work_id":"62385026-52ba-4763-b546-145835fffc6f","year":2017},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.345996Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:0dcead675b8af8951bf65030228472c63915f1674a615c39d29832867e8f3e57","observation_id":"319d947c-d892-4f0d-8097-87d60163ae15","resolution":{"observed_at":"2026-08-15T21:16:14.247973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15381","last_updated":"2024-09-09T22:49:17Z","snapshot_observed_at":"2026-08-16T13:23:23.370882Z","submitted_at":"2024-08-27T19:45:26Z","title":"On Stateful Value Factorization in Multi-Agent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2408.15381","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.15381","snapshot_observed_at":"2026-08-15T21:16:13.599286Z","title":"On Stateful Value Factorization in Multi-Agent Reinforcement Learning","venue":"cs.AI","work_id":"7c45a384-b39f-46f6-ad2b-b2d139d6de18","year":2024},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.350758Z"},"links":{"cited_paper":"/paper/2408.15381","citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:3c34304aab7b8466984381372b4d72bc2b72afc16c39d3bc5e90ac857efc59d4","observation_id":"64ddc08d-2015-464b-8e0e-202931483bbf","resolution":{"observed_at":"2026-08-15T21:16:13.606724Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.227482Z","title":"Oliehoek and Christopher Amato","venue":null,"work_id":"a6452351-84a5-4b0c-a557-c2ce07eb30b4","year":2016},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.355620Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:47d6b923520a575a4c2c3c9b3a8b0f3501c73dd2ecac465a9cedbc761182eeab","observation_id":"05a8aa1e-467d-454e-8504-c99cc7131c45","resolution":{"observed_at":"2026-08-15T21:16:14.232581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.360340Z","title":"Approximation theory of the MLP model in neural networks","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.360340Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:36ad25c108798e2214be66b912236f7916775473a527f5025a3be69a89e3abff","observation_id":"6e529edc-9510-4c3a-b749-cb68c1b806e9","resolution":{"observed_at":"2026-08-15T21:16:13.360340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.212399Z","title":"Weighted QMIX: Expand- ing Monotonic Value Function Factorisation for Deep Multi-Agent Reinforcement Learning","venue":null,"work_id":"2f7d9d1e-06b9-4ea1-8037-101fa30ef0bb","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.365190Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:12a79e27e2fdf4cf7a1d8151ef5df2a7e0fcbbe16da89a7c0ffe328f5d3d5fed","observation_id":"5e07e191-992d-4db0-9014-843c6f7656ba","resolution":{"observed_at":"2026-08-15T21:16:14.217379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.196862Z","title":"Monotonic Value Function Factorisation for Deep Multi-Agent Reinforcement Learning","venue":null,"work_id":"57c3c11c-1b17-4de5-a083-a3c41256a420","year":2020},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.370555Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:abd62c7c1a0c1da620d3cc63a52bcd3cfadc81b3dc669850f6547b45c6339562","observation_id":"35309acd-c774-43cb-919d-377e450f4dc1","resolution":{"observed_at":"2026-08-15T21:16:14.202319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.181465Z","title":"JaxMARL: Multi-Agent RL Environments and Algorithms in JAX","venue":null,"work_id":"532f398a-9d86-43d5-b633-c95f7811bc85","year":2024},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.375948Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:525061e6cfc5d6ca5db8b29f35fb431fefab7251e65ffc5c31c41d2c61b164ca","observation_id":"9b98e59c-8da1-4d39-9cc6-fadfa1f37fed","resolution":{"observed_at":"2026-08-15T21:16:14.186418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.164986Z","title":"QTRAN: Learning to Factorize with Transformation for Cooperative Multi-Agent Reinforcement Learn- ing","venue":null,"work_id":"51879c1c-b0de-4767-b2fa-df437bcc0c39","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.381020Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:37a4215311dd68acc7d2486c2bcba92b232e5f545d99267f044aa715d503f918","observation_id":"f1aad31b-a421-4f2d-93f6-74d0f144c0ec","resolution":{"observed_at":"2026-08-15T21:16:14.170331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-08-14T20:53:35.783079Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-08-15T21:16:13.390697Z","title":"Leibo, Karl Tuyls, and Thore Graepel","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.390697Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:61f1e08b844f291a5e9e29127742d29a2505762519ae5ab0b15276f3d43c6f47","observation_id":"ce318488-ae01-437c-811c-a065ceb5edc3","resolution":{"observed_at":"2026-08-15T21:16:13.390697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.134333Z","title":"QPLEX: Duplex Dueling Multi-Agent Q-Learning","venue":null,"work_id":"a82c694b-78a9-47cd-a8bc-ff6f781a4708","year":2020},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.395948Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:3d770facfdb83670eebfef296f4507ee7a30d22bf51fdf217682fefd2ac38a33","observation_id":"9472af51-f23c-4267-b047-65ef27f79ca1","resolution":{"observed_at":"2026-08-15T21:16:14.139202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.119112Z","title":"Towards Understanding Cooperative Multi-Agent Q-Learning with Value Factorization","venue":null,"work_id":"060d357d-3440-4cf7-8fbb-0874eaf7a09e","year":2021},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.400641Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:97e599ddcbbbc1db74cb2dba74788867d525cc6f51854af9e0a912857960a037","observation_id":"ba744468-a33a-4174-83c6-8a5c07a2b1b3","resolution":{"observed_at":"2026-08-15T21:16:14.123982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.102956Z","title":"strong” forms of UAT not formally applicable, and come to the primary conclusions that (i) only “weak","venue":null,"work_id":"e65e11d0-12de-4477-b0e6-260442cc3e95","year":1995},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.409749Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:14d1703d023809d8bb1fde7a5c55877aa0a158ce239685d5ec65d8ea5729745c","observation_id":"bfea6062-67d3-407a-99d7-643e813deccd","resolution":{"observed_at":"2026-08-15T21:16:14.108539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.087480Z","title":null,"venue":null,"work_id":"8def6a27-e418-48f4-a1c7-e7d8b1225e7a","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.414915Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:6f43dc50d5e86e673ff779a90b8b135f6f9cd15b96dfdd18f44408eabb157613","observation_id":"31389fc3-f51f-4bf0-9bf3-6020237ee1f4","resolution":{"observed_at":"2026-08-15T21:16:14.092145Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.071232Z","title":"Step 1 was already proven earlier","venue":null,"work_id":"84cb78f2-2c71-4278-bd21-44ed43ef46cb","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.419518Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:38b155654198f6aa707f9a6f4c6b21c5aa0d299a8511c1a89d3b4dd2681d7268","observation_id":"af4f94c6-49c4-44b0-8edf-8230a7307bc0","resolution":{"observed_at":"2026-08-15T21:16:14.076081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.054837Z","title":null,"venue":null,"work_id":"373993d2-f0ce-4c40-8dff-9e76578a13a0","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.424966Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:60dddf413500eed6f6feda957c9a9471d629f825c4f443e650dfc3654ebc8087","observation_id":"0e13f432-f61b-4e4e-9e0e-caa4aa5d68eb","resolution":{"observed_at":"2026-08-15T21:16:14.060272Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.039910Z","title":null,"venue":null,"work_id":"7466d67a-c4bc-448e-a419-ae53927e9ffa","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.429253Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:59217052c6297ff1e68fc195f19c7e03a3e0b0bb78d3421e2196f22112a842b0","observation_id":"c10e5c90-f1bf-4802-a59a-276073060f88","resolution":{"observed_at":"2026-08-15T21:16:14.044261Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.025060Z","title":null,"venue":null,"work_id":"1c51887c-96f2-445c-8955-0b1eba1be44b","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.433903Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:27c264b2ac9098d25590bfc390ab420b1f86bddea233ca05a9ee0df5b853593e","observation_id":"f8fc2925-4450-4cbc-993b-be9ae36b8e75","resolution":{"observed_at":"2026-08-15T21:16:14.030054Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.009109Z","title":"X” over VDN. 0 2 M 4 M 6 M 8 M 10 M Timesteps 0% 25% 50% 75% 100%Pr(X > Q+FIX-sum) Model Q+FIX-sum Q+FIX-mono Q+FIX-lin QPLEX QMIX VDN (b) POI of model “X","venue":null,"work_id":"23494e67-878b-4f99-b2a2-d8bfa78364ad","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.438634Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:e9bdd2adef1457b0e1d09cace6361baf1ab5cc5e2596d56394cc531bd3d8b62d","observation_id":"831562a0-8669-4a16-9625-1412b60b28ba","resolution":{"observed_at":"2026-08-15T21:16:14.014285Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.992789Z","title":"Guidelines: • The answer NA means that the abstract and introduction do not include the claims made in the paper","venue":null,"work_id":"ff97a6fa-8be0-4cff-bf6f-a80bc2204b15","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.444469Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:612404837831f8ea460df9ed97ca481c985cbd1f6ab042733373b5dcef70acfd","observation_id":"5c2a4547-938f-47c6-a3a2-5636202f65e4","resolution":{"observed_at":"2026-08-15T21:16:13.997730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.976975Z","title":"Limitations","venue":null,"work_id":"897864cf-45c9-4eeb-a5a0-eabbb528da25","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.449151Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:5fec9864e94cde48dc89a8355ee3ab8ac8b001bbfd5489ed730f69797dffa3e8","observation_id":"cab75a2a-20b6-46dc-a5cb-25c90069538d","resolution":{"observed_at":"2026-08-15T21:16:13.982079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.961146Z","title":"Proof sketches were omitted in the main document due to the proofs being strictly technical, and space limitations","venue":null,"work_id":"c08e57e6-9dcd-4d91-98f7-dbe4673deb6a","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.454030Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:cfdcd9727cdd22aa8bf5a12ea57db381372d225367cafda556b09e90067ef5db","observation_id":"32f9a792-52cf-4b70-a054-3385f34237dd","resolution":{"observed_at":"2026-08-15T21:16:13.966332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.943397Z","title":"Guidelines: • The answer NA means that the paper does not include experiments","venue":null,"work_id":"459749a5-80cd-4ef2-95ac-f53099c07980","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.459189Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:8c4ccf743a074bc217076a180b1088e614181252ed783e76877926bfd075a49e","observation_id":"10c0417c-6b13-4509-bffa-4981ea3043b3","resolution":{"observed_at":"2026-08-15T21:16:13.948267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.927029Z","title":"Instructions for the Pymarl2 imple- mentation are provided in the readme","venue":null,"work_id":"f8e71841-4aa9-4b38-8c41-3f8bfafdb107","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.464605Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:6831a14717c24f83c7393acc938ddeff4bfd8ed7204c632d845e4b8cf2431e2f","observation_id":"ea0a9f25-2608-4b3b-90b9-92c15692785a","resolution":{"observed_at":"2026-08-15T21:16:13.932200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.909559Z","title":"Any additional component (e.g., the architectures of Q+FIX) is both described in the appendix, provided as supplementary material, and will be linked in the camera ready)","venue":null,"work_id":"dbaac2f5-feba-47b3-b948-e5c06a6c4288","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.470157Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:d289eb2dd5718b6928ebd807d3e02a8fde275f649fc35d710ffe555eea3ecd81","observation_id":"881cb253-74a8-43f5-9f9e-dd80e232e2cb","resolution":{"observed_at":"2026-08-15T21:16:13.915624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.894289Z","title":"30 Guidelines: • The answer NA means that the paper does not include experiments","venue":null,"work_id":"ecb7adb6-1b66-4cb3-84cf-a438697813dd","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.474770Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:dc6907857c9ab125f7e0b902fe80d539516fb172b3389b41e12a454f820a0817","observation_id":"7eb5c3bf-be52-4974-89c1-eaaccbd79df1","resolution":{"observed_at":"2026-08-15T21:16:13.899179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.878525Z","title":"Guidelines: • The answer NA means that the paper does not include experiments","venue":null,"work_id":"e4944eb7-6e4a-45bc-805f-9c65111a8b14","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.479499Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:a4df2c882211c6a1d40689bac8427ae0f2f44497d9cf152c90aec16492c77e9d","observation_id":"cf311fb4-8669-4027-884d-73681e896931","resolution":{"observed_at":"2026-08-15T21:16:13.883365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.862672Z","title":"Guidelines: • The answer NA means that the authors have not reviewed the NeurIPS Code of Ethics","venue":null,"work_id":"a83f03e1-aa75-4046-8090-c916478da2a3","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.484547Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:4f7b1cfe29a332476a22a322619b2c51a385fdab531971f3e3c387a1af8f8fc8","observation_id":"510df453-739c-4fe6-af91-918d30c7d1d5","resolution":{"observed_at":"2026-08-15T21:16:13.867762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.845872Z","title":"Guidelines: • The answer NA means that there is no societal impact of the work performed","venue":null,"work_id":"f34b17fd-99d9-48ff-8971-a319203a6634","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.489787Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:b4c74a4a540a86c8eff5ef00d2a4928f80901239b830060ffe7687b4ca6953f9","observation_id":"c135fa70-c6e6-4648-a995-491b7c44efb6","resolution":{"observed_at":"2026-08-15T21:16:13.851568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.495269Z","title":"Guidelines: • The answer NA means that the paper poses no such risks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.495269Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:42f8a3592d59e35c803581208f5d4ae8a5bf5ab41e431d33a1652c3fb6cd89e7","observation_id":"afb78ee5-74f9-4211-8a34-f31104942437","resolution":{"observed_at":"2026-08-15T21:16:13.495269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.819855Z","title":"Our own implementations continue to use the same license","venue":null,"work_id":"636227ff-1f6a-43a8-a4d7-164a195b200a","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.500140Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:741dab0c86765d714a521f79c9463aad49ecc992c43a81e59bd015c34cbf26ae","observation_id":"a32521cc-6d37-4431-82a1-da5859a361b2","resolution":{"observed_at":"2026-08-15T21:16:13.824815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.803384Z","title":"These will be provided as forks from the corresponding repositories","venue":null,"work_id":"3ee0d003-fb04-4a7b-a08d-1a2b32412b89","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.504937Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:3010ead6cc472ea0be6e9c2bd228da51bc641319a4cb8fd9c67dd66ee4cd0ec5","observation_id":"7149d4e6-4076-494e-b95c-75d78a61afce","resolution":{"observed_at":"2026-08-15T21:16:13.808383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.509930Z","title":"Guidelines: • The answer NA means that the paper does not involve crowdsourcing nor research with human subjects","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.509930Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:5e7eb948a57ef13bdeb58aa30c6462ae5340e7cd6a63afd673b43ddab0bfafce","observation_id":"99216728-c6c2-4764-8904-6c60370bcf53","resolution":{"observed_at":"2026-08-15T21:16:13.509930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.777459Z","title":"Guidelines: • The answer NA means that the paper does not involve crowdsourcing nor research with human subjects","venue":null,"work_id":"0163590d-a1ee-4759-85eb-ed836716c40a","year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.515014Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:2e685d785ac4d0a93badca710a69849c7dc06b3057fc29bd61bb94f3511c46e2","observation_id":"efbd9c8a-04c3-4ea0-be34-11e5f63e000c","resolution":{"observed_at":"2026-08-15T21:16:13.782856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:13.760698Z","title":"Answer: [NA] Justification: The core method development in this research does not involve LLMs as any important, original, or non-standard components","venue":null,"work_id":"7d565da3-9f4c-4f6a-8623-7ee58fad4fed","year":2025},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.519936Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:7705a86607680dfeaee16a0b69d5c62aaee0a915d302e1f8076f48ae7dec8a3b","observation_id":"6ccd11fc-55da-43ed-9cc0-2cc13dff3f31","resolution":{"observed_at":"2026-08-15T21:16:13.765635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-15T21:16:13.336147Z","title":"arXiv:1412.6980 [cs]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.336147Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:fdde9cb80aea6a4ee2d723dc7f2bf3f56a0b1dfb79dc1a5c4e2916fc8e64664f","observation_id":"191ede31-c902-4d49-9df9-19dfc4e13d17","resolution":{"observed_at":"2026-08-15T21:16:13.336147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:16:14.149637Z","title":"URL https://proceedings.mlr.press/v97/son19a.html","venue":null,"work_id":"3bd39af2-84a8-4832-81c8-e5654911f583","year":2019},"citing_paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning","version":1},"reference_index":5896,"source":"pdf_text","source_observed_at":"2026-08-15T21:16:13.386077Z"},"links":{"citing_paper":"/paper/2505.10484"},"observation_digest":"sha256:aea0105cdb246e58e9d25262b82a31638e1c9c4a5510f8cc52b60755911c4980","observation_id":"7f2fed18-76d5-43ec-9a5f-7b3f90fc9e4a","resolution":{"observed_at":"2026-08-15T21:16:14.154631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.10484","last_updated":"2025-05-15T16:36:18Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T17:09:10.544024Z","submitted_at":"2025-05-15T16:36:18Z","title":"Fixing Incomplete Value Function Decomposition for Multi-Agent Reinforcement Learning"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":1,"verified_fuzzy":27},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2505.10484."}