{"as_of":"2026-08-10T06:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a72135cfcf5c13adf8240971e4bd438ef916978cd9aae8b643777e698027a072","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T10:52:39.226530Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.02875/citation-record","integrity":"/paper/2502.02875/integrity","json":"/paper/2502.02875/citation-record.json","paper":"/paper/2502.02875"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:52:39.306233Z","title":"In Add-HPF-WQ, WQMIX[Rashid et al., 2020] is chosen as πα in Eq.(4) of the main text","venue":null,"work_id":"7300d3e5-b2ae-41a9-a908-92999488cea3","year":2020},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.226530Z"},"links":{"citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:59b03e30dee482a38c6e588159c0cd324e05070ed28425ebef55807a44e667f6","observation_id":"0bfafc7c-79ea-4598-862c-eb2f8408a3c3","resolution":{"observed_at":"2026-08-09T10:52:39.311661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:52:39.320495Z","title":null,"venue":null,"work_id":"58114942-7474-420c-a159-215172471f73","year":2022},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.222682Z"},"links":{"citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:9d6bf48f9e9cb1898a254e8847149dd3f7a3a6f8daf9008a2ce1d2fdfbc2a43f","observation_id":"452da334-49db-45c0-8e58-102408fbb5eb","resolution":{"observed_at":"2026-08-09T10:52:39.324543Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:52:39.555225Z","title":"Mac-po: Multi-agent experience replay via collective priority optimization","venue":null,"work_id":"461d3f51-477c-4e83-8e1b-de348ec22adc","year":2023},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.131932Z"},"links":{"citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:975825c1aaf9936edc873aacc9e972109aea2bd4288758a46ac1d3f9509db2fc","observation_id":"36563a75-d17f-4666-b5d7-9232204216d5","resolution":{"observed_at":"2026-08-09T10:52:39.560252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:52:39.543415Z","title":"Rusu, Joel Veness, Marc G","venue":null,"work_id":"f90f60e6-4a72-4b7c-be3e-a02a3fddc48f","year":2015},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.137370Z"},"links":{"citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:2a7b56ae52afe88b4f05209166d3fe9dedd61fabc73ea2e167c1baac712c314c","observation_id":"0d993f8f-de43-4dcb-80e8-00186b4ac524","resolution":{"observed_at":"2026-08-09T10:52:39.547585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:52:39.488773Z","title":"Foerster, and Shimon Whiteson","venue":null,"work_id":"e6a763b4-33d9-4bb2-95bf-db3208d16de0","year":2018},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.158334Z"},"links":{"citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:59aabe8184fe49aa94ab53cf4c225286f055956c26fa76afda2c8d922ed30375","observation_id":"3f4e0dab-f869-4a14-bd16-5489d963efeb","resolution":{"observed_at":"2026-08-09T10:52:39.493577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:52:39.461045Z","title":null,"venue":null,"work_id":"40bdebda-7d60-4792-956e-49f42af40a32","year":2019},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.166318Z"},"links":{"citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:f2bc7d9ad873d8ad28f1fdf62a638086d34e93870cd2bb2c28e4035ba6d61f32","observation_id":"bc89016e-5dff-4648-ae08-1ffe27e05d17","resolution":{"observed_at":"2026-08-09T10:52:39.465116Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:52:39.170354Z","title":"Resq: A residual q function-based approach for multi-agent reinforcement learning value factoriza- tion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.170354Z"},"links":{"citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:a4ebd3a09821b4a60acdc997baa16d82488ff110c6af955e8bf1aaedaa78c41f","observation_id":"20053a46-ddea-4bf7-ada0-fbe94848746b","resolution":{"observed_at":"2026-08-09T10:52:39.170354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:52:39.174222Z","title":"Qtran: Learn- ing to factorize with transformation for cooperative multi- agent reinforcement learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.174222Z"},"links":{"citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:1b9461c6149d354bb076acf66ee55b2ad55e5c04f591fec9261dca5bda9a5f49","observation_id":"fcf699ab-7b0a-4c98-a005-3bc782cfcfa4","resolution":{"observed_at":"2026-08-09T10:52:39.174222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.12010","last_updated":"2020-10-06T01:50:57Z","snapshot_observed_at":"2026-07-06T09:31:14.331447Z","submitted_at":"2020-06-22T05:08:36Z","title":"QTRAN++: Improved Value Transformation for Cooperative Multi-Agent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.12010","snapshot_observed_at":"2026-08-09T10:52:39.178648Z","title":"Qtran++: improved value transformation for cooperative multi-agent reinforcement learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.178648Z"},"links":{"cited_paper":"/paper/2006.12010","citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:d00892774b4a170b50b0b0230d35bb498a7a24de9de31264702b9e5feb49a979","observation_id":"6298ab67-4325-4cf8-a22d-7b98cc075b45","resolution":{"observed_at":"2026-08-09T10:52:39.178648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-08-09T10:52:39.182907Z","title":"Value-decomposition networks for cooperative multi-agent learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.182907Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:5a72cfc6e501dcd62a979b21ce7c11a3070d35f8e25ca2f54c11a2cc437f1a66","observation_id":"c2ebb545-c632-46e2-a3df-aeed1912aa5f","resolution":{"observed_at":"2026-08-09T10:52:39.182907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:52:39.418157Z","title":"Multi-agent reinforcement learning: Independent vs","venue":null,"work_id":"9b80cde0-fd3d-4cb7-9eeb-07aab9ed4949","year":1993},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.191301Z"},"links":{"citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:38d0b67d49b785d8e64238f3b918ff65af3eb3c0853e597255587da36f167976","observation_id":"32185cd0-23c1-4b1c-864e-aca99fee568f","resolution":{"observed_at":"2026-08-09T10:52:39.422267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:52:39.388874Z","title":"Vgn: Value decomposition with graph atten- tion networks for multiagent reinforcement learning.IEEE Transactions on Neural Networks and Learning Systems ,","venue":null,"work_id":"8425099d-2be5-418d-bf94-0ce08b2cc243","year":2022},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.199381Z"},"links":{"citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:929924995e180bcda5733bd1e55fd0987dc6f392dbb1002da0ee1a54f60cdf56","observation_id":"4c5fcb77-36f7-4b6e-a457-f57f8a54467d","resolution":{"observed_at":"2026-08-09T10:52:39.394068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:52:39.373680Z","title":"Haven: Hierarchical coop- erative multi-agent reinforcement learning with dual coor- dination mechanism","venue":null,"work_id":"a2991294-864d-4d76-9b14-6bf58d6eaada","year":2023},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.203970Z"},"links":{"citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:15dacccbd5b189a81bac1cba3f109bf8259c65815d554c5aca7aafde7068b12f","observation_id":"97f36579-57ca-4750-8c06-3b010b8e19d4","resolution":{"observed_at":"2026-08-09T10:52:39.378229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.03939","last_updated":"2020-06-09T05:20:11Z","snapshot_observed_at":"2026-07-06T08:56:13.036996Z","submitted_at":"2020-02-10T16:48:03Z","title":"Qatten: A General Framework for Cooperative Multiagent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.03939","snapshot_observed_at":"2026-08-09T10:52:39.207654Z","title":"Qatten: A general framework for coopera- tive multiagent reinforcement learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.207654Z"},"links":{"cited_paper":"/paper/2002.03939","citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:4cffa303d9999d29f2462ea0323d7f3c7c91975888a8505237519d6dffec7306","observation_id":"26dedabd-f6e9-4de1-8803-63ee930b9024","resolution":{"observed_at":"2026-08-09T10:52:39.207654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:52:39.360304Z","title":"Causal inference multi-agent rein- forcement learning for traffic signal control","venue":null,"work_id":"19b95827-1d5c-4e9d-8042-abe20cf60137","year":2023},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.211726Z"},"links":{"citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:fa54758e46fd571abdf55a389c0d54c7311ffb9ae1de214c42e77d3daddc6c02","observation_id":"f860d93d-3ef5-4646-8cfe-0e8195d2b77d","resolution":{"observed_at":"2026-08-09T10:52:39.364814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:52:39.346280Z","title":"Game of drones: Multi-uav pursuit-evasion game with online motion plan- ning by deep reinforcement learning","venue":null,"work_id":"be38b2ba-d089-4e75-a67a-45480a510483","year":2023},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.215452Z"},"links":{"citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:d0604acca0000b029935b0c1d35405c4326b77da326bae197a1e84ff2a0d0b51","observation_id":"de32fc82-bd4b-41e8-aaca-3ee85f1209fd","resolution":{"observed_at":"2026-08-09T10:52:39.351593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:52:39.333024Z","title":"Locality matters: A scalable value decompo- sition approach for cooperative multi-agent reinforcement learning","venue":null,"work_id":"0db60298-1b61-4b19-b164-1ade18a91270","year":2022},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.219181Z"},"links":{"citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:be8b7c1173864d43545b92c9875acbb05b276ce65cd43ccdcace43a27aec61e2","observation_id":"c93075cc-fc53-4677-b4d6-7992f00dce1e","resolution":{"observed_at":"2026-08-09T10:52:39.337596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:52:39.404177Z","title":"{QPLEX}: Duplex duel- ing multi-agent q-learning","venue":null,"work_id":"44028194-790e-4a5a-afb7-ecb48a7b986c","year":2021},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":1993,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.194990Z"},"links":{"citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:185a87cce331b589e4265d547400c8e034d5482b2c62b048ddb513ae9dbf51a5","observation_id":"aabec551-280f-47d2-8795-e40d958c9804","resolution":{"observed_at":"2026-08-09T10:52:39.409106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.04740","last_updated":"2021-02-10T07:33:31Z","snapshot_observed_at":"2026-08-03T16:36:35.235872Z","submitted_at":"2020-10-09T18:01:01Z","title":"Graph Convolutional Value Decomposition in Multi-Agent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.04740","snapshot_observed_at":"2026-08-09T10:52:39.141965Z","title":"Graph convo- lutional value decomposition in multi-agent reinforcement learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.141965Z"},"links":{"cited_paper":"/paper/2010.04740","citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:82bcffb9f91c5ebdb17cab6adc885aa074afbf08b9ab937112394f26c2a5d9be","observation_id":"f3fd1ea1-0396-4a11-aa80-ce8eeaa8fc7a","resolution":{"observed_at":"2026-08-09T10:52:39.141965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:52:39.515085Z","title":"Multi-agent reinforcement learning for redun- dant robot control in task-space","venue":null,"work_id":"7f944f5e-ff93-4d6d-8053-5f620560d44e","year":2021},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.150433Z"},"links":{"citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:378526bf5a95ee436603f924dc9cc6b6e0e6bad2122dd89b0e107cfc32715ae3","observation_id":"4adbc12a-65d4-4570-a7fc-6bb2725d7672","resolution":{"observed_at":"2026-08-09T10:52:39.519281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:52:39.430648Z","title":"Sutton and Andrew G","venue":null,"work_id":"6442a9e7-3f25-4958-a719-61121694030b","year":2018},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.187371Z"},"links":{"citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:1309be0c3759b471d5b9a32330579684e1bcbe71a0b834a66ee0194eb6723fa4","observation_id":"81352af1-46a4-461c-af39-c289893b000f","resolution":{"observed_at":"2026-08-09T10:52:39.435058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:52:39.473748Z","title":"Weighted qmix: Expand- ing monotonic value function factorisation for deep multi- agent reinforcement learning","venue":null,"work_id":"c2f94792-d229-497c-af77-07217717656a","year":2020},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.162368Z"},"links":{"citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:01b9f775cf337c0397d06664e1f7f1445df4a6907d63a7444dce9e85311c7312","observation_id":"cfcd1d1a-5449-44a3-812d-7e2eef70209e","resolution":{"observed_at":"2026-08-09T10:52:39.478668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:52:39.583485Z","title":"Transformer-based value function decomposition for cooperative multi-agent rein- forcement learning in starcraft","venue":null,"work_id":"89ac490f-cb81-4acd-8075-27405098231b","year":2022},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.123204Z"},"links":{"citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:e88836c839d5b5607acfc3c06a4ca93b71c47991fe556e6d79cc94b210431fdd","observation_id":"27c17cd1-f590-4951-bc7e-2b38d1c1bcd8","resolution":{"observed_at":"2026-08-09T10:52:39.590203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:52:39.529545Z","title":"Oliehoek and Christo- pher Amato","venue":null,"work_id":"b956836a-e657-4748-8999-73fb03599b1f","year":2016},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.146774Z"},"links":{"citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:69a6715d5854f6ea246f2356e6370592acab05a4424fb1bddc5ea24130dd3ca2","observation_id":"5d2d8f1e-b4aa-4fbe-8ce6-c211e0253ca3","resolution":{"observed_at":"2026-08-09T10:52:39.534292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:52:39.502276Z","title":"Residual q-networks for value function factorizing in multiagent reinforcement learning","venue":null,"work_id":"52d60f27-6d9f-470c-b57b-26230cf65100","year":2022},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.154186Z"},"links":{"citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:43d9cfe1c36ed5136fd70f09321f834ca75114caaec1709c82374c89ced42643","observation_id":"fa10284f-8e83-4571-96bc-475735041d12","resolution":{"observed_at":"2026-08-09T10:52:39.506737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:52:39.569757Z","title":"Contrastive identity-aware learning for multi-agent value decomposition","venue":null,"work_id":"9d98d7ba-0e39-48c0-9d6f-d94aa0d3887c","year":2023},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.127561Z"},"links":{"citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:82370f6cd1e265550a333feb26ffa83449f6e3b3d434c4e04a494dbb25c27c80","observation_id":"6dd3f448-a283-4919-af1c-d3f37afb9059","resolution":{"observed_at":"2026-08-09T10:52:39.574178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:52:39.602308Z","title":"Social influence as intrinsic motivation for multi-agent deep reinforcement learning","venue":null,"work_id":"7d9c63b3-03c0-4681-b896-23088cc8ede5","year":2019},"citing_paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T10:52:39.118705Z"},"links":{"citing_paper":"/paper/2502.02875"},"observation_digest":"sha256:a5e4ae3200521aab5287803e9f2ffb1c1e128641b437aadd6d8085d3abcfb70e","observation_id":"e7fa604a-c5ea-41ca-9dcd-7b925367d503","resolution":{"observed_at":"2026-08-09T10:52:39.608401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.02875","last_updated":"2025-02-05T04:30:06Z","latest_version":1,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-09T10:45:37.039353Z","submitted_at":"2025-02-05T04:30:06Z","title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":0,"verified_fuzzy":19},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2502.02875."}