{"as_of":"2026-08-10T20:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:aec15861de240aaae40a2cfe3947a6478d73b7f9747676da40086d61b4a74463","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T16:42:04.090374Z","state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.17924/citation-record","integrity":"/paper/2607.17924/integrity","json":"/paper/2607.17924/citation-record.json","paper":"/paper/2607.17924"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-01T16:42:02.462350Z","title":"Is independent learning all you need in the starcraft multi-agent challenge?arXiv preprint arXiv:2011.09533,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.17924","last_updated":"2026-07-20T13:20:29Z","snapshot_observed_at":"2026-08-09T18:19:58.774153Z","submitted_at":"2026-07-20T13:20:29Z","title":"Aggregate in the Advantage, Not the Ratio: A Canonical-Form Analysis of Cooperative Multi-Agent Policy Optimization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T16:42:02.462350Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2607.17924"},"observation_digest":"sha256:c863bed16240e51b0b8dfb5bf069c38fe857749706ad937b141cdfc67dc9378a","observation_id":"dfb80bfe-04ff-4c44-bc48-6d234cb14935","resolution":{"observed_at":"2026-08-01T16:42:02.462350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.13472","last_updated":"2026-07-27T13:24:09Z","snapshot_observed_at":"2026-08-02T16:21:01.098429Z","submitted_at":"2026-04-15T04:52:22Z","title":"Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.13472","snapshot_observed_at":"2026-08-01T16:42:03.341501Z","title":"Zijian Zhao, Jing Gao, and Sen Li","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17924","last_updated":"2026-07-20T13:20:29Z","snapshot_observed_at":"2026-08-09T18:19:58.774153Z","submitted_at":"2026-07-20T13:20:29Z","title":"Aggregate in the Advantage, Not the Ratio: A Canonical-Form Analysis of Cooperative Multi-Agent Policy Optimization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T16:42:03.341501Z"},"links":{"cited_paper":"/paper/2604.13472","citing_paper":"/paper/2607.17924"},"observation_digest":"sha256:83b241b93b708cfff5c7f158d9511df4a999ea6f893b78582ea9737e004ef18b","observation_id":"e86fa2a0-4660-40d3-8c4f-a290712c33d6","resolution":{"observed_at":"2026-08-01T16:42:03.341501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:42:03.917531Z","title":null,"venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.17924","last_updated":"2026-07-20T13:20:29Z","snapshot_observed_at":"2026-08-09T18:19:58.774153Z","submitted_at":"2026-07-20T13:20:29Z","title":"Aggregate in the Advantage, Not the Ratio: A Canonical-Form Analysis of Cooperative Multi-Agent Policy Optimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T16:42:03.917531Z"},"links":{"citing_paper":"/paper/2607.17924"},"observation_digest":"sha256:acea050891db800f0877afd72cd39cecfa5b2dac0c431be3a62e842ccbc36d0a","observation_id":"7f9ffecb-a468-438e-b0bc-786abaf1f2c7","resolution":{"observed_at":"2026-08-01T16:42:03.917531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:42:04.090374Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17924","last_updated":"2026-07-20T13:20:29Z","snapshot_observed_at":"2026-08-09T18:19:58.774153Z","submitted_at":"2026-07-20T13:20:29Z","title":"Aggregate in the Advantage, Not the Ratio: A Canonical-Form Analysis of Cooperative Multi-Agent Policy Optimization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T16:42:04.090374Z"},"links":{"citing_paper":"/paper/2607.17924"},"observation_digest":"sha256:d847f7c7f4164c77ee8cb46ffa2e9f5640f2b2089231144feef38ab78a58ebdb","observation_id":"3d652191-670e-4ac6-beae-fb61a0474d0f","resolution":{"observed_at":"2026-08-01T16:42:04.090374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-08-09T23:04:15.431743Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-01T16:42:03.179272Z","title":"Scalable multi-agent reinforcement learning for networked systems with average reward.Advances in Neural Information Processing Systems, 33:2074–2086, 2020a","venue":null,"work_id":null,"year":2074},"citing_paper":{"arxiv_id":"2607.17924","last_updated":"2026-07-20T13:20:29Z","snapshot_observed_at":"2026-08-09T18:19:58.774153Z","submitted_at":"2026-07-20T13:20:29Z","title":"Aggregate in the Advantage, Not the Ratio: A Canonical-Form Analysis of Cooperative Multi-Agent Policy Optimization","version":1},"reference_index":1994,"source":"pdf_text","source_observed_at":"2026-08-01T16:42:03.179272Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2607.17924"},"observation_digest":"sha256:132ffc99ffaf4f81d4be9c873ef6adfb1034986655df45f99b8372e74ca108e1","observation_id":"70fece1c-6a00-458e-a4cf-a8cf22f55e76","resolution":{"observed_at":"2026-08-01T16:42:03.179272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:42:03.687268Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.17924","last_updated":"2026-07-20T13:20:29Z","snapshot_observed_at":"2026-08-09T18:19:58.774153Z","submitted_at":"2026-07-20T13:20:29Z","title":"Aggregate in the Advantage, Not the Ratio: A Canonical-Form Analysis of Cooperative Multi-Agent Policy Optimization","version":1},"reference_index":2011,"source":"pdf_text","source_observed_at":"2026-08-01T16:42:03.687268Z"},"links":{"citing_paper":"/paper/2607.17924"},"observation_digest":"sha256:dc9e96a8f0e2ee74ed8285e53d484e8c5dfa6830088b32c59e45367891e82f54","observation_id":"98b8ac4a-bf9b-41ac-bb3d-c29bff3ef3e2","resolution":{"observed_at":"2026-08-01T16:42:03.687268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13415","last_updated":"2025-03-17T17:45:46Z","snapshot_observed_at":"2026-08-07T16:57:08.042985Z","submitted_at":"2025-03-17T17:45:46Z","title":"A Comprehensive Survey on Multi-Agent Cooperative Decision-Making: Scenarios, Approaches, Challenges and Perspectives","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13415","snapshot_observed_at":"2026-08-01T16:42:02.557564Z","title":"A comprehen- sive survey on multi-agent cooperative decision-making: Scenarios, approaches, challenges and perspectives.arXiv preprint arXiv:2503.13415,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17924","last_updated":"2026-07-20T13:20:29Z","snapshot_observed_at":"2026-08-09T18:19:58.774153Z","submitted_at":"2026-07-20T13:20:29Z","title":"Aggregate in the Advantage, Not the Ratio: A Canonical-Form Analysis of Cooperative Multi-Agent Policy Optimization","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-01T16:42:02.557564Z"},"links":{"cited_paper":"/paper/2503.13415","citing_paper":"/paper/2607.17924"},"observation_digest":"sha256:375ba363a44059caaf76e8db8aea2e9107a36f4d10d80bec68e88f6565353837","observation_id":"28c4cdc4-dd85-4fcf-88e9-e25e415ddba4","resolution":{"observed_at":"2026-08-01T16:42:02.557564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:42:02.386172Z","title":"Sumo–simulation of urban mobility: an overview","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.17924","last_updated":"2026-07-20T13:20:29Z","snapshot_observed_at":"2026-08-09T18:19:58.774153Z","submitted_at":"2026-07-20T13:20:29Z","title":"Aggregate in the Advantage, Not the Ratio: A Canonical-Form Analysis of Cooperative Multi-Agent Policy Optimization","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-01T16:42:02.386172Z"},"links":{"citing_paper":"/paper/2607.17924"},"observation_digest":"sha256:9f12e5c8c27a12c0810053651d96bbe8acc56f81f94fdf3b851c2ea3f51b2225","observation_id":"a830c2a8-6882-4e8d-9f3e-8dd3eb6a4478","resolution":{"observed_at":"2026-08-01T16:42:02.386172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:42:02.957872Z","title":"Markov games as a framework for multi-agent reinforcement learning","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2607.17924","last_updated":"2026-07-20T13:20:29Z","snapshot_observed_at":"2026-08-09T18:19:58.774153Z","submitted_at":"2026-07-20T13:20:29Z","title":"Aggregate in the Advantage, Not the Ratio: A Canonical-Form Analysis of Cooperative Multi-Agent Policy Optimization","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-01T16:42:02.957872Z"},"links":{"citing_paper":"/paper/2607.17924"},"observation_digest":"sha256:5d7b1405f0385a2166c0a49e9a18a9d563e68ccfbdd87d7e69fec54a84215c43","observation_id":"9cdcdc7e-db66-4795-8f60-5af32579eef5","resolution":{"observed_at":"2026-08-01T16:42:02.957872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:42:03.520863Z","title":"13 B.2 Proof of Lemma 2 (multiplicative variance)","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2607.17924","last_updated":"2026-07-20T13:20:29Z","snapshot_observed_at":"2026-08-09T18:19:58.774153Z","submitted_at":"2026-07-20T13:20:29Z","title":"Aggregate in the Advantage, Not the Ratio: A Canonical-Form Analysis of Cooperative Multi-Agent Policy Optimization","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T16:42:03.520863Z"},"links":{"citing_paper":"/paper/2607.17924"},"observation_digest":"sha256:acc14725eeefa960b0e8ae1e1b91d1dee41e351a8a79158165b93c1a6ae4fd05","observation_id":"647be801-6234-4bea-b8bc-1ab307dcc323","resolution":{"observed_at":"2026-08-01T16:42:03.520863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:42:02.678810Z","title":"Generalized per-agent advantage estimation for multi-agent policy optimization.arXiv preprint arXiv:2603.02654,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17924","last_updated":"2026-07-20T13:20:29Z","snapshot_observed_at":"2026-08-09T18:19:58.774153Z","submitted_at":"2026-07-20T13:20:29Z","title":"Aggregate in the Advantage, Not the Ratio: A Canonical-Form Analysis of Cooperative Multi-Agent Policy Optimization","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T16:42:02.678810Z"},"links":{"citing_paper":"/paper/2607.17924"},"observation_digest":"sha256:55083df861100f557b974e7ddaf94d5776ce6b12d88d3960c4a4423baf5b861e","observation_id":"1326ed37-126f-4953-9039-bc2868288590","resolution":{"observed_at":"2026-08-01T16:42:02.678810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T16:42:02.792432Z","title":"Trust region policy optimisation in multi-agent reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17924","last_updated":"2026-07-20T13:20:29Z","snapshot_observed_at":"2026-08-09T18:19:58.774153Z","submitted_at":"2026-07-20T13:20:29Z","title":"Aggregate in the Advantage, Not the Ratio: A Canonical-Form Analysis of Cooperative Multi-Agent Policy Optimization","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-01T16:42:02.792432Z"},"links":{"citing_paper":"/paper/2607.17924"},"observation_digest":"sha256:ad4714307b446a86d6c6bae3d10060bad7a6972c18465e99f7fe464c6181a1ee","observation_id":"45d08777-a3d6-49ab-accc-75a350072ee6","resolution":{"observed_at":"2026-08-01T16:42:02.792432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.17924","last_updated":"2026-07-20T13:20:29Z","latest_version":1,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-09T18:19:58.774153Z","submitted_at":"2026-07-20T13:20:29Z","title":"Aggregate in the Advantage, Not the Ratio: A Canonical-Form Analysis of Cooperative Multi-Agent Policy Optimization"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 0 inbound Pith citation observations for arXiv:2607.17924."}