Pith. sign in

Paper Citation Record · LEDGER

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation

As of 10 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2502.02875.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2502.02875 v1

Coverage vector

measured 27 of 27 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-09T10:52:39.226530Z

measured 27 of 27 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-09T06:31:02.800959+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

27 of 27 outbound references displayed

  • verified exact0
  • verified fuzzy19
  • unresolved8
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 0bfafc7c-79ea-4598-862c-eb2f8408a3c3 · outbound

This paper cites In Add-HPF-WQ, WQMIX[Rashid et al., 2020] is chosen as πα in Eq.(4) of the main text.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation In Add-HPF-WQ, WQMIX[Rashid et al., 2020] is chosen as πα in Eq.(4) of the main text

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T10:52:39.311661Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T10:52:39.226530Z digest=sha256:8ff68a798ef58400c0f120529ac8cb0b1dc03df8356ee77a2f09a77f4c5e85ef

Observation 452da334-49db-45c0-8e58-102408fbb5eb · outbound

This paper cites an unresolved cited work.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation Unresolved cited work

Reference 2

Resolution
unresolved
raw_fallback, observed 2026-08-09T10:52:39.324543Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T10:52:39.222682Z digest=sha256:d956175d5e63be54b983cdc9a1127d54659923076db455b63670f987fd0cc3e0

Observation 36563a75-d17f-4666-b5d7-9232204216d5 · outbound

This paper cites Mac-po: Multi-agent experience replay via collective priority optimization.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation Mac-po: Multi-agent experience replay via collective priority optimization

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T10:52:39.560252Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T10:52:39.131932Z digest=sha256:84bd4ef21079b7971121df51580aa50ebce3a48a6cc9d933a6605b9ce1dbfdbd

Observation 0d993f8f-de43-4dcb-80e8-00186b4ac524 · outbound

This paper cites Rusu, Joel Veness, Marc G.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation Rusu, Joel Veness, Marc G

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T10:52:39.547585Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T10:52:39.137370Z digest=sha256:c6bc8cfac0c5267a6c1e3bc11f349b1f8d8dfb74c47ee05da46adf24dba50ed6

Observation 3f4e0dab-f869-4a14-bd16-5489d963efeb · outbound

This paper cites Foerster, and Shimon Whiteson.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation Foerster, and Shimon Whiteson

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T10:52:39.493577Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T10:52:39.158334Z digest=sha256:4632bdb8bb561573e2dde49feadf96a3e1f377687aac2a568e6eba0bf29174b8

Observation bc89016e-5dff-4648-ae08-1ffe27e05d17 · outbound

This paper cites an unresolved cited work.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-08-09T10:52:39.465116Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T10:52:39.166318Z digest=sha256:83ba1b3fcfa376020b741244f3c3ae5002fa0972c7b65c45090819a215053c6b

Observation 20053a46-ddea-4bf7-ada0-fbe94848746b · outbound

This paper cites Resq: A residual q function-based approach for multi-agent reinforcement learning value factoriza- tion.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation Resq: A residual q function-based approach for multi-agent reinforcement learning value factoriza- tion

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-09T10:52:39.170354Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T10:52:39.170354Z digest=sha256:a4ebd3a09821b4a60acdc997baa16d82488ff110c6af955e8bf1aaedaa78c41f

Observation fcf699ab-7b0a-4c98-a005-3bc782cfcfa4 · outbound

This paper cites Qtran: Learn- ing to factorize with transformation for cooperative multi- agent reinforcement learning.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation Qtran: Learn- ing to factorize with transformation for cooperative multi- agent reinforcement learning

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-09T10:52:39.174222Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T10:52:39.174222Z digest=sha256:1b9461c6149d354bb076acf66ee55b2ad55e5c04f591fec9261dca5bda9a5f49

Observation 6298ab67-4325-4cf8-a22d-7b98cc075b45 · outbound

This paper cites QTRAN++: Improved Value Transformation for Cooperative Multi-Agent Reinforcement Learning.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation QTRAN++: Improved Value Transformation for Cooperative Multi-Agent Reinforcement Learning

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-09T10:52:39.178648Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T10:52:39.178648Z digest=sha256:d00892774b4a170b50b0b0230d35bb498a7a24de9de31264702b9e5feb49a979

Observation c2ebb545-c632-46e2-a3df-aeed1912aa5f · outbound

This paper cites Value-Decomposition Networks For Cooperative Multi-Agent Learning.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation Value-Decomposition Networks For Cooperative Multi-Agent Learning

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-09T10:52:39.182907Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T10:52:39.182907Z digest=sha256:5a72cfc6e501dcd62a979b21ce7c11a3070d35f8e25ca2f54c11a2cc437f1a66

Observation 32185cd0-23c1-4b1c-864e-aca99fee568f · outbound

This paper cites Multi-agent reinforcement learning: Independent vs.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation Multi-agent reinforcement learning: Independent vs

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T10:52:39.422267Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T10:52:39.191301Z digest=sha256:58abab2422ee58341d708217f332a448a4759043b314a66bfb7dca91f0e795f1

Observation 4c5fcb77-36f7-4b6e-a457-f57f8a54467d · outbound

This paper cites Vgn: Value decomposition with graph atten- tion networks for multiagent reinforcement learning.IEEE Transactions on Neural Networks and Learning Systems ,.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation Vgn: Value decomposition with graph atten- tion networks for multiagent reinforcement learning.IEEE Transactions on Neural Networks and Learning Systems ,

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T10:52:39.394068Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T10:52:39.199381Z digest=sha256:5285875a30f6ae22a05fce2b114ff30338ed5c3f076f708f143e3339420d8aab

Observation 97f36579-57ca-4750-8c06-3b010b8e19d4 · outbound

This paper cites Haven: Hierarchical coop- erative multi-agent reinforcement learning with dual coor- dination mechanism.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation Haven: Hierarchical coop- erative multi-agent reinforcement learning with dual coor- dination mechanism

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T10:52:39.378229Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T10:52:39.203970Z digest=sha256:7de00eb6bc9cf97d66f8f4df308ac850c5997b3733f1ac5e926136b25c83ab48

Observation 26dedabd-f6e9-4de1-8803-63ee930b9024 · outbound

This paper cites Qatten: A General Framework for Cooperative Multiagent Reinforcement Learning.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation Qatten: A General Framework for Cooperative Multiagent Reinforcement Learning

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-09T10:52:39.207654Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T10:52:39.207654Z digest=sha256:4cffa303d9999d29f2462ea0323d7f3c7c91975888a8505237519d6dffec7306

Observation f860d93d-3ef5-4646-8cfe-0e8195d2b77d · outbound

This paper cites Causal inference multi-agent rein- forcement learning for traffic signal control.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation Causal inference multi-agent rein- forcement learning for traffic signal control

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T10:52:39.364814Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T10:52:39.211726Z digest=sha256:20f8e08fc0ee26cca1c882bd25c1fc77934f96d57ac25ab7a3d060cf4f291196

Observation de32fc82-bd4b-41e8-aaca-3ee85f1209fd · outbound

This paper cites Game of drones: Multi-uav pursuit-evasion game with online motion plan- ning by deep reinforcement learning.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation Game of drones: Multi-uav pursuit-evasion game with online motion plan- ning by deep reinforcement learning

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T10:52:39.351593Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T10:52:39.215452Z digest=sha256:3279f9ba2de97e7684f104cc0e87f98286abd31260d92b12a47fe1aa4b84e3bf

Observation c93075cc-fc53-4677-b4d6-7992f00dce1e · outbound

This paper cites Locality matters: A scalable value decompo- sition approach for cooperative multi-agent reinforcement learning.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation Locality matters: A scalable value decompo- sition approach for cooperative multi-agent reinforcement learning

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T10:52:39.337596Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T10:52:39.219181Z digest=sha256:ea9b14de2ceeeb6c79efa7759d86b7a4304155b880b7f93aeda3b06b1f6f203f

Observation aabec551-280f-47d2-8795-e40d958c9804 · outbound

This paper cites {QPLEX}: Duplex duel- ing multi-agent q-learning.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation {QPLEX}: Duplex duel- ing multi-agent q-learning

Reference 1993

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T10:52:39.409106Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T10:52:39.194990Z digest=sha256:2cf80fbf154b2ba737f4e8a2db1fd684cb3809d4e0fb68b7c0eb1f45e0d6eb2a

Observation f3fd1ea1-0396-4a11-aa80-ce8eeaa8fc7a · outbound

This paper cites Graph Convolutional Value Decomposition in Multi-Agent Reinforcement Learning.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation Graph Convolutional Value Decomposition in Multi-Agent Reinforcement Learning

Reference 2015

Resolution
unresolved
no resolver link, observed 2026-08-09T10:52:39.141965Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T10:52:39.141965Z digest=sha256:82bcffb9f91c5ebdb17cab6adc885aa074afbf08b9ab937112394f26c2a5d9be

Observation 4adbc12a-65d4-4570-a7fc-6bb2725d7672 · outbound

This paper cites Multi-agent reinforcement learning for redun- dant robot control in task-space.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation Multi-agent reinforcement learning for redun- dant robot control in task-space

Reference 2016

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T10:52:39.519281Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T10:52:39.150433Z digest=sha256:628f2c14c65ea71d8e3dadb58d688165bf42eb623853fe50e5fa5d0586a31527

Observation 81352af1-46a4-461c-af39-c289893b000f · outbound

This paper cites Sutton and Andrew G.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation Sutton and Andrew G

Reference 2017

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T10:52:39.435058Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T10:52:39.187371Z digest=sha256:0111245c16124e33db10d918d7ad1dd2037a4a41177b57decb120ce6e08f0246

Observation cfcd1d1a-5449-44a3-812d-7e2eef70209e · outbound

This paper cites Weighted qmix: Expand- ing monotonic value function factorisation for deep multi- agent reinforcement learning.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation Weighted qmix: Expand- ing monotonic value function factorisation for deep multi- agent reinforcement learning

Reference 2018

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T10:52:39.478668Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T10:52:39.162368Z digest=sha256:68247fd3fc9f17238c82bc418cdd803a06807bc97967e97874bf1a864502979a

Observation 27c17cd1-f590-4951-bc7e-2b38d1c1bcd8 · outbound

This paper cites Transformer-based value function decomposition for cooperative multi-agent rein- forcement learning in starcraft.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation Transformer-based value function decomposition for cooperative multi-agent rein- forcement learning in starcraft

Reference 2019

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T10:52:39.590203Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T10:52:39.123204Z digest=sha256:5d29bd17cb98a2250be50131ec829fa61458ec050e1f8042cc8fcc9181be0ba5

Observation 5d2d8f1e-b4aa-4fbe-8ce6-c211e0253ca3 · outbound

This paper cites Oliehoek and Christo- pher Amato.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation Oliehoek and Christo- pher Amato

Reference 2020

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T10:52:39.534292Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T10:52:39.146774Z digest=sha256:8446ada72028592356216bcaf26382674875bc56012f463f62dc95ba9627177c

Observation fa10284f-8e83-4571-96bc-475735041d12 · outbound

This paper cites Residual q-networks for value function factorizing in multiagent reinforcement learning.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation Residual q-networks for value function factorizing in multiagent reinforcement learning

Reference 2021

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T10:52:39.506737Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T10:52:39.154186Z digest=sha256:d4e3d7941babdea4051e519a1e517cac31e951b88235296f89153f60a5d2da36

Observation 6dd3f448-a283-4919-af1c-d3f37afb9059 · outbound

This paper cites Contrastive identity-aware learning for multi-agent value decomposition.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation Contrastive identity-aware learning for multi-agent value decomposition

Reference 2022

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T10:52:39.574178Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T10:52:39.127561Z digest=sha256:c1eecb8d053c7355ab28c49f199ad449d77da5814735e2292b3e85bf5b21f56a

Observation e7fa604a-c5ea-41ca-9dcd-7b925367d503 · outbound

This paper cites Social influence as intrinsic motivation for multi-agent deep reinforcement learning.

Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation Social influence as intrinsic motivation for multi-agent deep reinforcement learning

Reference 2023

Resolution
verified fuzzy
raw_fallback, observed 2026-08-09T10:52:39.608401Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.

source=pdf_text observed=2026-08-09T10:52:39.118705Z digest=sha256:56cdffa381e7569bdcfff9d7252a79e093ec66582a199a5602b253aae03d664f

Pith citing papers

No inbound Pith citation observations are available.