{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:QP23YJXVX4VZBW3A7K25O7Y4OW","short_pith_number":"pith:QP23YJXV","schema_version":"1.0","canonical_sha256":"83f5bc26f5bf2b90db60fab5d77f1c758266b0702d2da3dd56b1d9ccc7626173","source":{"kind":"arxiv","id":"2502.02875","version":1},"attestation_state":"computed","paper":{"title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.MA","authors_text":"Jinliang Shao, Ruoning Zhang, Siying Wang, Wenyu Chen, Yang Zhou, Yuhua Cheng, Zhitong Zhao","submitted_at":"2025-02-05T04:30:06Z","abstract_excerpt":"Value decomposition (VD) has become one of the most prominent solutions in cooperative multi-agent reinforcement learning. Most existing methods generally explore how to factorize the joint value and minimize the discrepancies between agent observations and characteristics of environmental states. However, direct decomposition may result in limited representation or difficulty in optimization. Orthogonal to designing a new factorization scheme, in this paper, we propose Heterogeneous Policy Fusion (HPF) to integrate the strengths of various VD methods. We construct a composite policy set to se"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2502.02875","kind":"arxiv","version":1},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.MA","submitted_at":"2025-02-05T04:30:06Z","cross_cats_sorted":[],"title_canon_sha256":"72709373dd4cd83d2b1ade9d0439ef2ffaa07a8c271f99f05b58457d57c57882","abstract_canon_sha256":"a8a477b6f9c338f4f7af5b709ebc13f69953a78d12f3788c4ad65bf7edabae17"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T10:09:56.217041Z","signature_b64":"1OFIm/TnYBI7YjBqGYWjC0pm36TU11URp/6XkXL4eS/XaWTpHxwxODKus547bTm7mMUZaDjLH4zrkLEm2cX8CQ==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"83f5bc26f5bf2b90db60fab5d77f1c758266b0702d2da3dd56b1d9ccc7626173","last_reissued_at":"2026-07-05T10:09:56.216587Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T10:09:56.216587Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Heterogeneous Value Decomposition Policy Fusion for Multi-Agent Cooperation","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.MA","authors_text":"Jinliang Shao, Ruoning Zhang, Siying Wang, Wenyu Chen, Yang Zhou, Yuhua Cheng, Zhitong Zhao","submitted_at":"2025-02-05T04:30:06Z","abstract_excerpt":"Value decomposition (VD) has become one of the most prominent solutions in cooperative multi-agent reinforcement learning. Most existing methods generally explore how to factorize the joint value and minimize the discrepancies between agent observations and characteristics of environmental states. However, direct decomposition may result in limited representation or difficulty in optimization. Orthogonal to designing a new factorization scheme, in this paper, we propose Heterogeneous Policy Fusion (HPF) to integrate the strengths of various VD methods. We construct a composite policy set to se"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2502.02875","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2502.02875/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2502.02875","created_at":"2026-07-05T10:09:56.216638+00:00"},{"alias_kind":"arxiv_version","alias_value":"2502.02875v1","created_at":"2026-07-05T10:09:56.216638+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2502.02875","created_at":"2026-07-05T10:09:56.216638+00:00"},{"alias_kind":"pith_short_12","alias_value":"QP23YJXVX4VZ","created_at":"2026-07-05T10:09:56.216638+00:00"},{"alias_kind":"pith_short_16","alias_value":"QP23YJXVX4VZBW3A","created_at":"2026-07-05T10:09:56.216638+00:00"},{"alias_kind":"pith_short_8","alias_value":"QP23YJXV","created_at":"2026-07-05T10:09:56.216638+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":0,"internal_anchor_count":0,"sample":[]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/QP23YJXVX4VZBW3A7K25O7Y4OW","json":"https://pith.science/pith/QP23YJXVX4VZBW3A7K25O7Y4OW.json","graph_json":"https://pith.science/api/pith-number/QP23YJXVX4VZBW3A7K25O7Y4OW/graph.json","events_json":"https://pith.science/api/pith-number/QP23YJXVX4VZBW3A7K25O7Y4OW/events.json","paper":"https://pith.science/paper/QP23YJXV"},"agent_actions":{"view_html":"https://pith.science/pith/QP23YJXVX4VZBW3A7K25O7Y4OW","download_json":"https://pith.science/pith/QP23YJXVX4VZBW3A7K25O7Y4OW.json","view_paper":"https://pith.science/paper/QP23YJXV","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2502.02875&json=true","fetch_graph":"https://pith.science/api/pith-number/QP23YJXVX4VZBW3A7K25O7Y4OW/graph.json","fetch_events":"https://pith.science/api/pith-number/QP23YJXVX4VZBW3A7K25O7Y4OW/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/QP23YJXVX4VZBW3A7K25O7Y4OW/action/timestamp_anchor","attest_storage":"https://pith.science/pith/QP23YJXVX4VZBW3A7K25O7Y4OW/action/storage_attestation","attest_author":"https://pith.science/pith/QP23YJXVX4VZBW3A7K25O7Y4OW/action/author_attestation","sign_citation":"https://pith.science/pith/QP23YJXVX4VZBW3A7K25O7Y4OW/action/citation_signature","submit_replication":"https://pith.science/pith/QP23YJXVX4VZBW3A7K25O7Y4OW/action/replication_record"}},"created_at":"2026-07-05T10:09:56.216638+00:00","updated_at":"2026-07-05T10:09:56.216638+00:00"}