{"as_of":"2026-08-04T20:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8f1e2d4ae73ec7e996b0e264fbb7eece6b37c6539fa9a33119e4b36c91ea0284","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":50,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T19:35:33.299036Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T19:30:07.924598Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"1906.12266","last_updated":"2019-06-28T15:35:11Z","snapshot_observed_at":"2026-07-06T08:03:38.968054Z","submitted_at":"2019-06-28T15:35:11Z","title":"Growing Action Spaces","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-25T13:24:59.682609Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/1906.12266"},"observation_digest":"sha256:31379ecea0b7d83ddb297b9cf9aecebf6eed2e47c0b109f017f1b81c04680c2f","observation_id":"21f69b57-3810-4938-b009-ea6ca7c1dfe6","resolution":{"observed_at":"2026-05-25T13:25:52.327460Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2502.02844","last_updated":"2025-06-18T06:49:09Z","snapshot_observed_at":"2026-07-06T20:31:17.809419Z","submitted_at":"2025-02-05T02:59:23Z","title":"Wolfpack Adversarial Attack for Robust Multi-Agent Reinforcement Learning","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-23T03:24:33.788346Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2502.02844"},"observation_digest":"sha256:cfcb1d065ccaefdd726725d81a5a1c44dc9a22abaecb55b5aba498436adc00b4","observation_id":"a1b3f358-17d5-4180-8e5e-c2984f5859b1","resolution":{"observed_at":"2026-05-23T03:25:20.302611Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2502.03506","last_updated":"2026-05-04T09:30:33Z","snapshot_observed_at":"2026-07-06T20:31:50.759186Z","submitted_at":"2025-02-05T12:06:54Z","title":"Optimistic {\\epsilon}-Greedy Exploration for Cooperative Multi-Agent Reinforcement Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-23T04:16:54.807723Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2502.03506"},"observation_digest":"sha256:086d1498da0960f340156487e6512aeabc9648854a66b809e461f405fda528e0","observation_id":"8ffdbc16-ac46-4810-a962-23a104ba1e77","resolution":{"observed_at":"2026-05-23T04:17:30.912295Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2502.13388","last_updated":"2026-04-10T14:53:27Z","snapshot_observed_at":"2026-07-06T20:38:57.586136Z","submitted_at":"2025-02-19T02:53:43Z","title":"Reflection of Episodes: Learning to Play Game from Expert and Self Experiences","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-23T03:09:43.596964Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2502.13388"},"observation_digest":"sha256:c1f799f93f30d7f669f5a6885628d90cfe57d0e73af01fce313809faf0a3ffb0","observation_id":"f8e7aae4-f630-4d2e-b547-5a61ff47db72","resolution":{"observed_at":"2026-05-23T03:12:28.489248Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2508.01049","last_updated":"2026-05-13T06:44:44Z","snapshot_observed_at":"2026-08-03T03:51:19.181251Z","submitted_at":"2025-08-01T20:07:25Z","title":"Centralized Adaptive Sampling for Reliable Co-Training of Independent Multi-Agent Policies","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-19T01:05:17.086399Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2508.01049"},"observation_digest":"sha256:5c46134b4b60aedf60e1fa8c45bcc93ee8b140c715b0ca94402d0637d21a46cb","observation_id":"12492a1f-4937-442a-90e6-bed2ae472dfe","resolution":{"observed_at":"2026-05-19T01:06:57.448961Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-08-04T19:35:33.299036Z","title":"Value-decomposition networks for cooperative multi-agent learning.arXiv preprint arXiv:1706.05296,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.09208","last_updated":"2025-09-11T07:33:35Z","snapshot_observed_at":"2026-08-04T19:35:32.983986Z","submitted_at":"2025-09-11T07:33:35Z","title":"Incentivizing Safer Actions in Policy Optimization for Constrained Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T19:35:33.299036Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2509.09208"},"observation_digest":"sha256:77a3898748f4c131d4b868d1c6dff9630e997bed9b8440242c22983b46ad519f","observation_id":"1e281c07-29d1-42fe-9fe2-7bc6451d9406","resolution":{"observed_at":"2026-08-04T19:35:33.299036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2509.15519","last_updated":"2026-05-09T02:35:26Z","snapshot_observed_at":"2026-07-06T22:30:17.163909Z","submitted_at":"2025-09-19T01:52:44Z","title":"Fully Decentralized Cooperative Multi-Agent Reinforcement Learning is A Context Modeling Problem","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-18T15:15:26.114479Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2509.15519"},"observation_digest":"sha256:623f2e7c3b65fb77f2040f84358757ed1453cef9daae129cd724ae195140ccda","observation_id":"e985d51c-3488-471a-9f9b-141599e91130","resolution":{"observed_at":"2026-05-18T15:16:32.258980Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2509.17676","last_updated":"2026-04-18T21:16:15Z","snapshot_observed_at":"2026-07-06T22:30:26.679189Z","submitted_at":"2025-09-22T12:19:46Z","title":"GLo-MAPPO: Multi-Agent Deep Reinforcement Learning for Energy-Efficient UAV-Assisted LoRa Networks","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-18T14:58:06.782237Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2509.17676"},"observation_digest":"sha256:c8a53444c5de07481586d20d803ac107ada0010c584b840314fb414d13aa305f","observation_id":"1105309e-5526-400a-97db-020f0efcffa4","resolution":{"observed_at":"2026-05-18T15:01:32.091405Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-08-04T14:41:50.880629Z","title":"Value-decomposition networks for cooperative multi-agent learning.arXiv preprint arXiv:1706.05296, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.24380","last_updated":"2026-07-04T03:50:21Z","snapshot_observed_at":"2026-08-04T14:41:42.802868Z","submitted_at":"2025-09-29T07:29:18Z","title":"Agentic Services Computing","version":3},"reference_index":162,"source":"pdf_text","source_observed_at":"2026-08-04T14:41:50.880629Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2509.24380"},"observation_digest":"sha256:84f4d26566abe778d2f732360bf02f7c8cad66d73ae538f10a2a4eae963a4fd7","observation_id":"14cda5d8-ec4c-4832-8604-611d7ca059ba","resolution":{"observed_at":"2026-08-04T14:41:50.880629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2601.07122","last_updated":"2026-05-18T01:45:16Z","snapshot_observed_at":"2026-08-02T09:25:53.571748Z","submitted_at":"2026-01-12T01:25:41Z","title":"Enhancing Cloud Network Resilience via a Robust LLM-Empowered Multi-Agent Reinforcement Learning Framework","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-21T16:28:22.036007Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2601.07122"},"observation_digest":"sha256:b3ccf3256b3c287a912b4607eecceedca918bbaa4de5642e741f3115eedad3a7","observation_id":"69c08d2a-b4a7-4e82-a605-ef7a617a1ca2","resolution":{"observed_at":"2026-05-21T16:30:22.077120Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2601.21972","last_updated":"2026-05-26T15:41:11Z","snapshot_observed_at":"2026-08-03T06:46:35.623443Z","submitted_at":"2026-01-29T16:50:30Z","title":"Learning Decentralized LLM Collaboration with Multi-Agent Actor Critic","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-16T09:47:47.051969Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2601.21972"},"observation_digest":"sha256:76ae41100a1c916409d79fb2980bdefff0fee1eef4f41720a5d9a738f82caf3e","observation_id":"15edaa42-740a-4b9e-83f3-884d5f70fafb","resolution":{"observed_at":"2026-05-16T09:50:49.356797Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-08-03T06:46:40.524856Z","title":"M., Zam- baldi, V ., Jaderberg, M., Lanctot, M., Sonnerat, N., Leibo, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.21972","last_updated":"2026-05-26T15:41:11Z","snapshot_observed_at":"2026-08-03T06:46:35.623443Z","submitted_at":"2026-01-29T16:50:30Z","title":"Learning Decentralized LLM Collaboration with Multi-Agent Actor Critic","version":5},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T06:46:40.524856Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2601.21972"},"observation_digest":"sha256:7a57da43a6e25391936c8d0fdd1b1e4bdbc317dda7faa628d38d179c5df6cf96","observation_id":"9c42f75c-e6c3-489c-b309-127b024ff62a","resolution":{"observed_at":"2026-08-03T06:46:40.524856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2602.20078","last_updated":"2026-05-05T11:51:06Z","snapshot_observed_at":"2026-07-06T22:46:45.213871Z","submitted_at":"2026-02-23T17:45:08Z","title":"Descent-Guided Policy Gradient for Scalable Cooperative Multi-Agent Learning","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-15T19:58:46.680878Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2602.20078"},"observation_digest":"sha256:49b9dc2964967457e2e0e49423a1bc35be49bef77f58ab563b049a6891a5e100","observation_id":"d369e9fd-59b0-469f-8136-c805f087bafb","resolution":{"observed_at":"2026-05-15T20:00:16.952016Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2604.03189","last_updated":"2026-04-03T17:05:45Z","snapshot_observed_at":"2026-07-06T22:52:25.307426Z","submitted_at":"2026-04-03T17:05:45Z","title":"Reflective Context Learning: Studying the Optimization Primitives of Context Space","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-13T20:29:13.761153Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2604.03189"},"observation_digest":"sha256:95615c472032cd15eefbf4a57b75f70f74febce9ff6406e1ccf9ef9477d0aab1","observation_id":"5f59326f-30ca-4bb2-90b4-c31b6a39817a","resolution":{"observed_at":"2026-05-13T20:33:16.983709Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2604.17191","last_updated":"2026-04-19T01:40:39Z","snapshot_observed_at":"2026-07-06T23:04:19.063534Z","submitted_at":"2026-04-19T01:40:39Z","title":"Do LLM-derived graph priors improve multi-agent coordination?","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T06:09:08.100187Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2604.17191"},"observation_digest":"sha256:d72fbf037bddb0d5bacaedf2cb247cbe097373c423ada09ca8c78d1dda8a06cf","observation_id":"76fcc335-e7a2-4f58-b66f-37371eae5430","resolution":{"observed_at":"2026-05-10T06:11:20.218625Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2604.22452","last_updated":"2026-04-24T11:11:36Z","snapshot_observed_at":"2026-07-06T23:08:51.913995Z","submitted_at":"2026-04-24T11:11:36Z","title":"Superminds Test: Actively Evaluating Collective Intelligence of Agent Society via Probing Agents","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-08T12:00:07.345611Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2604.22452"},"observation_digest":"sha256:a69a67168830e08a40a3fde7aa81d4f45b0bea259d2e0df91974a58bbf269060","observation_id":"6f33302e-bc9b-478d-b62d-bf7db6c64bc7","resolution":{"observed_at":"2026-05-11T19:26:08.797238Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2605.00751","last_updated":"2026-05-01T16:02:58Z","snapshot_observed_at":"2026-08-02T16:01:52.357634Z","submitted_at":"2026-05-01T16:02:58Z","title":"NonZero: Interaction-Guided Exploration for Multi-Agent Monte Carlo Tree Search","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-09T19:08:50.518219Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2605.00751"},"observation_digest":"sha256:04bcf0f43cc8e9ab4dc41e2d6c96e81190b5a19733a113fc46af0374d0c25819","observation_id":"ee6ba16b-75e9-4888-9809-f5e949e3783c","resolution":{"observed_at":"2026-05-11T15:51:43.028844Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2605.05727","last_updated":"2026-06-10T08:34:41Z","snapshot_observed_at":"2026-07-06T23:18:17.333660Z","submitted_at":"2026-05-07T06:19:07Z","title":"LLM-Enhanced Deep Reinforcement Learning for Task Offloading in Collaborative Edge Computing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-08T05:35:12.809203Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2605.05727"},"observation_digest":"sha256:f9025a8c6fd25d7948bed501addab1a674dcb36e824eefcea2b693c324070295","observation_id":"a2f532c2-b896-48dd-8ded-4a1363a28891","resolution":{"observed_at":"2026-05-11T21:26:16.730070Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2605.05727","last_updated":"2026-06-10T08:34:41Z","snapshot_observed_at":"2026-07-06T23:18:17.333660Z","submitted_at":"2026-05-07T06:19:07Z","title":"LLM-Enhanced Deep Reinforcement Learning for Task Offloading in Collaborative Edge Computing","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T23:40:59.430355Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2605.05727"},"observation_digest":"sha256:a1e5d8db58c49e91060eafb320361c3f358374fff94c3a5577f2b35b18040bc4","observation_id":"45acce93-7cfc-44f8-ba95-1d6f5ed31810","resolution":{"observed_at":"2026-06-30T23:45:08.156777Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2605.06557","last_updated":"2026-05-07T16:50:53Z","snapshot_observed_at":"2026-07-06T23:19:00.794334Z","submitted_at":"2026-05-07T16:50:53Z","title":"Coordination Matters: Evaluation of Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-08T03:34:57.125810Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2605.06557"},"observation_digest":"sha256:0263b919c9b1c03b1ee3da04989f52863e4021d17326ac5ac24b91f86e427d1c","observation_id":"b852f61f-c39e-424c-bc24-4bef6d2f7f3d","resolution":{"observed_at":"2026-05-11T22:01:12.582517Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2605.06825","last_updated":"2026-05-07T18:27:15Z","snapshot_observed_at":"2026-07-06T23:19:15.382283Z","submitted_at":"2026-05-07T18:27:15Z","title":"Randomness is sometimes necessary for coordination","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-05-11T01:01:38.215613Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2605.06825"},"observation_digest":"sha256:ffe35864a1177d34b9d072ae81891d37cdb5913b19f4d6f70c884c3291f8a15a","observation_id":"e136a762-18ab-40a2-b523-1171c191a2ee","resolution":{"observed_at":"2026-05-11T04:50:57.851450Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2605.08391","last_updated":"2026-05-19T01:58:16Z","snapshot_observed_at":"2026-07-06T23:20:38.385189Z","submitted_at":"2026-05-08T19:00:34Z","title":"SACHI: Structured Agent Coordination via Holistic Information Integration in Multi-Agent Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T01:31:19.576223Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2605.08391"},"observation_digest":"sha256:5f78d2f3ddeacb2274ec592bfd5eb764d5126149536fe3ea8eb94d5892f1cc9b","observation_id":"5fb11de7-1fd3-45b2-b691-5b5c14058382","resolution":{"observed_at":"2026-05-12T07:56:27.364955Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2605.08391","last_updated":"2026-05-19T01:58:16Z","snapshot_observed_at":"2026-07-06T23:20:38.385189Z","submitted_at":"2026-05-08T19:00:34Z","title":"SACHI: Structured Agent Coordination via Holistic Information Integration in Multi-Agent Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-20T22:34:46.440511Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2605.08391"},"observation_digest":"sha256:e020d1f9b5e489643439f642ef3e59a281b7794b06e26b995750fdc21988951c","observation_id":"452e39d7-2e7a-4bdc-b9a9-317803e94442","resolution":{"observed_at":"2026-05-20T22:39:10.750452Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2605.11880","last_updated":"2026-05-12T09:56:24Z","snapshot_observed_at":"2026-08-03T04:45:05.948236Z","submitted_at":"2026-05-12T09:56:24Z","title":"Adaptive TD-Lambda for Cooperative Multi-agent Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-13T06:02:43.375474Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2605.11880"},"observation_digest":"sha256:202a9f3d699512db77248d2a9a8272d5d4e5eb0355f5b2b7f212760819db500e","observation_id":"e237e516-5749-4150-a7c0-298ca305138b","resolution":{"observed_at":"2026-05-13T06:07:22.504840Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2605.13554","last_updated":"2026-05-13T13:58:49Z","snapshot_observed_at":"2026-08-01T19:52:28.213526Z","submitted_at":"2026-05-13T13:58:49Z","title":"Self-Supervised On-Policy Reinforcement Learning via Contrastive Proximal Policy Optimisation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-14T20:12:07.920183Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2605.13554"},"observation_digest":"sha256:449fe396cdcef5594e977d3e3c4c82f49a51503efcef8a670ed5df6d3383255d","observation_id":"64c626c7-ff75-4079-88e2-56cd99525b7f","resolution":{"observed_at":"2026-05-14T20:12:55.153793Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2605.14235","last_updated":"2026-05-14T01:03:41Z","snapshot_observed_at":"2026-08-01T15:58:07.815126Z","submitted_at":"2026-05-14T01:03:41Z","title":"Quantum Advantage in Multi Agent Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T01:47:50.831972Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2605.14235"},"observation_digest":"sha256:b195ce1a6ce253fe002cf01409cca54c40a5cd8684f78eb7560c67d78bf12e09","observation_id":"cc8aaf90-7ccb-4f25-a94b-bc3261434234","resolution":{"observed_at":"2026-05-15T01:48:28.094133Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2605.14892","last_updated":"2026-05-15T09:12:41Z","snapshot_observed_at":"2026-07-06T23:26:18.733776Z","submitted_at":"2026-05-14T14:36:13Z","title":"Beyond Individual Intelligence: Surveying Collaboration, Failure Attribution, and Self-Evolution in LLM-based Multi-Agent Systems","version":1},"reference_index":205,"source":"arxiv_source","source_observed_at":"2026-05-15T03:07:38.232966Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2605.14892"},"observation_digest":"sha256:a416e9e67ec43ae70b9797b313011b1b8a8fc78babab092c8cdd513db3863b1a","observation_id":"a80837c3-86c7-40b1-ba9f-4c0048adceed","resolution":{"observed_at":"2026-05-15T03:08:58.031657Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2605.14892","last_updated":"2026-05-15T09:12:41Z","snapshot_observed_at":"2026-07-06T23:26:18.733776Z","submitted_at":"2026-05-14T14:36:13Z","title":"Beyond Individual Intelligence: Surveying Collaboration, Failure Attribution, and Self-Evolution in LLM-based Multi-Agent Systems","version":2},"reference_index":206,"source":"arxiv_source","source_observed_at":"2026-05-19T16:51:13.491389Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2605.14892"},"observation_digest":"sha256:880ff588d780e68a3c5336b60aa759a7365922cc0851cac7c6554ea07592769d","observation_id":"6ffb02bc-6e2c-48f0-9f60-ab1c697de211","resolution":{"observed_at":"2026-05-19T16:52:39.995474Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2605.18024","last_updated":"2026-05-29T10:46:49Z","snapshot_observed_at":"2026-08-02T13:13:12.078195Z","submitted_at":"2026-05-18T08:14:38Z","title":"Interaction-Breaking Adversarial Learning Framework for Robust Multi-Agent Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-20T12:23:11.320751Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2605.18024"},"observation_digest":"sha256:bbb320176a3d7702cb5c96896b8e6d80623fcf177e5810e0257ac9e3dcbcc1bf","observation_id":"1b3c80dc-bae5-41a1-9406-483087df6cbb","resolution":{"observed_at":"2026-05-20T12:23:16.743957Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2605.18024","last_updated":"2026-05-29T10:46:49Z","snapshot_observed_at":"2026-08-02T13:13:12.078195Z","submitted_at":"2026-05-18T08:14:38Z","title":"Interaction-Breaking Adversarial Learning Framework for Robust Multi-Agent Reinforcement Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T18:47:09.501908Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2605.18024"},"observation_digest":"sha256:2fef81a55878957bdad83511bc64c3fb1dbe2808a338d8864c43d1deb48f88f6","observation_id":"dcdf6bfc-4a80-44df-8a81-b0f891c8b2de","resolution":{"observed_at":"2026-06-30T18:55:00.849117Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2605.18809","last_updated":"2026-05-12T01:02:01Z","snapshot_observed_at":"2026-07-06T23:29:38.069295Z","submitted_at":"2026-05-12T01:02:01Z","title":"Metric-Gradient Projection for Stable Multi-Agent Policy Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T22:13:00.107205Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2605.18809"},"observation_digest":"sha256:5fe14c928f4241dcf81d07526b041f3708c39e3f74937ea8303ba7c08a7bcfdb","observation_id":"71da555e-6cdf-4216-9200-4bdc9f925f19","resolution":{"observed_at":"2026-05-20T22:13:46.750682Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2605.24516","last_updated":"2026-05-23T11:01:49Z","snapshot_observed_at":"2026-08-03T05:27:47.335072Z","submitted_at":"2026-05-23T11:01:49Z","title":"Adaptive Punishment for Cooperation in Mixed-Motive Games","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T12:17:53.847812Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2605.24516"},"observation_digest":"sha256:0702238da631988a902acf0484d34d1e280d810568890774a15fd2077e01e203","observation_id":"aeb66533-00e7-4eb6-8f39-3d53493298e3","resolution":{"observed_at":"2026-06-30T12:24:39.839569Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2605.25584","last_updated":"2026-05-25T08:33:40Z","snapshot_observed_at":"2026-08-02T15:02:47.503172Z","submitted_at":"2026-05-25T08:33:40Z","title":"Acting on the Unseen: Communication-Free Collaborative Filtering for Decentralized Multi-Robot Task Allocation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-29T21:53:16.504181Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2605.25584"},"observation_digest":"sha256:91d0a013e4267be34e8027d6dd08b0164f434d8afd7cfd324a1ad4f482d4c0ca","observation_id":"bfa75ecb-5ed9-4bc8-94ca-7493b35e5ae2","resolution":{"observed_at":"2026-06-29T21:53:58.955453Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2606.07200","last_updated":"2026-06-05T12:08:37Z","snapshot_observed_at":"2026-08-02T23:31:07.326469Z","submitted_at":"2026-06-05T12:08:37Z","title":"Learning Multi-Agent Communication Protocol: Study on Information Entropy Efficiency in MARL","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-27T20:24:08.842135Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2606.07200"},"observation_digest":"sha256:27c14aa951bae90f7baf5f57c44c6cbe3f51807578e63dfa1e5ebebb545cbf07","observation_id":"18b1b1a6-be1f-4d92-b702-fc763a5c766d","resolution":{"observed_at":"2026-07-02T20:27:22.514032Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2606.08064","last_updated":"2026-06-06T09:01:18Z","snapshot_observed_at":"2026-08-02T11:39:24.452233Z","submitted_at":"2026-06-06T09:01:18Z","title":"Cooperative Long Rope Skipping via Multi-Agent Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-27T19:46:31.662942Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2606.08064"},"observation_digest":"sha256:184d99d98ca1754e2c432079ac581c8efbf17fe9da39686bbec4928e55432b32","observation_id":"e7abb6e6-dd8c-4203-afa7-0d5971f666d4","resolution":{"observed_at":"2026-07-02T21:27:24.460649Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2606.08068","last_updated":"2026-07-08T15:21:39Z","snapshot_observed_at":"2026-07-12T14:47:31.355938Z","submitted_at":"2026-06-06T09:33:32Z","title":"DICE: Entropy-Regularized Equilibrium Selection for Stable Multi-Agent LLM Coordination","version":1},"reference_index":208,"source":"arxiv_source","source_observed_at":"2026-06-27T19:58:32.016341Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2606.08068"},"observation_digest":"sha256:a6dcd81ded2c61d6959751b9e68614bd4a57484cdf95eea8241d534409c34368","observation_id":"56d01977-ff13-4a44-845a-cb19c32dbf50","resolution":{"observed_at":"2026-07-02T20:57:23.989549Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2606.08102","last_updated":"2026-06-10T11:06:40Z","snapshot_observed_at":"2026-08-03T01:44:22.063210Z","submitted_at":"2026-06-06T11:07:13Z","title":"Continual Quadruped Robots Coordination via Semantic Skill Discovery","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-27T19:37:53.168569Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2606.08102"},"observation_digest":"sha256:d8a29965d1ce0ae3a9a0c82a7c0a16a68c58ebb9d52c35a8590e3e00964e264f","observation_id":"fa44bb7c-ffa3-49f1-a1b9-97360e57a3a9","resolution":{"observed_at":"2026-07-02T21:37:25.176584Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2606.10129","last_updated":"2026-06-08T20:06:25Z","snapshot_observed_at":"2026-07-06T23:49:22.753911Z","submitted_at":"2026-06-08T20:06:25Z","title":"Discovering Interpretable Multi-Parameter Control Policies for Evolutionary Algorithms Using Deep Reinforcement Learning","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-06-27T17:29:31.604234Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2606.10129"},"observation_digest":"sha256:8a7008bbdc03f8f1852071c5cf370cc08a4945af3a76d3a889399133eef0234d","observation_id":"1e4778a3-e938-4fcf-83b5-7259f5ee6745","resolution":{"observed_at":"2026-07-03T00:07:28.189107Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2606.11284","last_updated":"2026-06-09T16:40:26Z","snapshot_observed_at":"2026-08-03T21:53:08.877881Z","submitted_at":"2026-06-09T16:40:26Z","title":"Phi-Actor-Critic: Steering General-Sum Games to Pareto-Efficient Correlated Equilibria","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-27T10:42:17.852996Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2606.11284"},"observation_digest":"sha256:9203edd39ed37c0be57542d23d38d7291cc175778ae085a5e3a6beee6ef19316","observation_id":"949d17b1-f280-41b2-bd1b-e4958f039b89","resolution":{"observed_at":"2026-07-03T08:47:50.446277Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-13T07:38:02.368884Z","title":"arXiv preprint arXiv:1706.05296 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.14130","last_updated":"2026-07-09T21:57:35Z","snapshot_observed_at":"2026-08-02T18:55:27.277790Z","submitted_at":"2026-06-12T05:30:53Z","title":"Contract-Based Compositional Shielding for Safe Multi-Agent Reinforcement Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-13T07:38:02.368884Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2606.14130"},"observation_digest":"sha256:467a3433cb8d72862304e4f60b36046de3ba573478c8289be55f523d979e62ad","observation_id":"ae136284-df7c-49b7-a5ba-f44d31ef2b66","resolution":{"observed_at":"2026-07-13T07:38:02.368884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2606.25389","last_updated":"2026-06-24T04:40:21Z","snapshot_observed_at":"2026-08-03T02:20:03.390753Z","submitted_at":"2026-06-24T04:40:21Z","title":"Offline Multi-agent Continual Cooperation via Skill Partition and Reuse","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-06-25T21:14:31.778575Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2606.25389"},"observation_digest":"sha256:2ced2a4bfaafd95fa7ae96b8e964350ad958dd9cc0cce6c1c51e7b85eafbf2d3","observation_id":"4465ad7a-0bcf-47f7-b262-5bee3fc3d38d","resolution":{"observed_at":"2026-07-04T19:30:07.925797Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2606.26574","last_updated":"2026-06-25T03:48:56Z","snapshot_observed_at":"2026-08-03T02:25:26.746357Z","submitted_at":"2026-06-25T03:48:56Z","title":"Revisiting Action Factorization for Complex Action Spaces","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-26T05:44:20.417806Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2606.26574"},"observation_digest":"sha256:35c2a2debfb50f1c46e2b8ca8f77e7970e3f08b5e40939a0558d88a22927d254","observation_id":"759da76a-67bf-4e57-b8e4-f9bbac83ad50","resolution":{"observed_at":"2026-07-04T12:59:52.037528Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2606.30092","last_updated":"2026-06-29T10:29:41Z","snapshot_observed_at":"2026-08-02T08:05:40.921118Z","submitted_at":"2026-06-29T10:29:41Z","title":"Hierarchical Reinforcement Learning in StarCraft Micromanagement with Influence Maps and Cluster-based Scripts","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-30T06:00:05.471833Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2606.30092"},"observation_digest":"sha256:866af40703b6899c658f545dd2d86430e205086c8ce4de872f03308f06fbad0f","observation_id":"859cb2d1-4bcd-4f42-a2a5-1cdf08954008","resolution":{"observed_at":"2026-06-30T06:04:21.512368Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":"1706.05296","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-04T19:30:07.924598Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","venue":"cs.AI","work_id":"97c129f4-4b12-4e2d-a662-3431772ad2f6","year":2017},"citing_paper":{"arxiv_id":"2606.30246","last_updated":"2026-06-29T12:56:08Z","snapshot_observed_at":"2026-07-07T00:04:05.275293Z","submitted_at":"2026-06-29T12:56:08Z","title":"Clarus: Coordinating Autonomous Research Agents toward Web-Scale Scientific Collaboration","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-30T06:15:29.120280Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2606.30246"},"observation_digest":"sha256:6e8550ae749b8773c846005ce4dd21c987028da55c334fcee3c81637398c9043","observation_id":"48619e02-3662-4db1-b1fd-876bfb5f1057","resolution":{"observed_at":"2026-06-30T07:24:22.533935Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-11T14:47:06.125148Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.04710","last_updated":"2026-07-06T06:26:43Z","snapshot_observed_at":"2026-08-02T11:31:23.906598Z","submitted_at":"2026-07-06T06:26:43Z","title":"Integrated Altruistic and Fairness Preference Induces Advanced Mutual Cooperation in Sequential Social Dilemmas","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-11T14:47:06.125148Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2607.04710"},"observation_digest":"sha256:68132680100483a6f55d953530d6500824668cae7118bcf8282fd3d39b285532","observation_id":"68dc8287-d031-46ba-9ef5-e62d50d80f9c","resolution":{"observed_at":"2026-07-11T14:47:06.125148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Value-decomposition networks for cooperative multi-agent learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:9214bb5a7cb78f289b022d660cda952381260a9115d65820b98ea92156b67664","observation_id":"fc67145e-d63a-487f-a903-ef1664593bb2","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-08-01T16:41:59.158511Z","title":"Value-decomposition networks for cooperative multi-agent learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.17914","last_updated":"2026-07-20T13:13:22Z","snapshot_observed_at":"2026-08-01T16:41:56.751565Z","submitted_at":"2026-07-20T13:13:22Z","title":"Value-Aware Prediction for Robust Multi-Agent Coordination Under Communication Loss","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T16:41:59.158511Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2607.17914"},"observation_digest":"sha256:05b0f6a08d92e19db5450569c582cb4c2a8c909fa6724c1dd0f8c32381d12c3a","observation_id":"ef06af3e-8852-4a78-9188-b2c145bad3b3","resolution":{"observed_at":"2026-08-01T16:41:59.158511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-08-01T15:04:29.757511Z","title":"arXiv preprint arXiv:1706.05296 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18597","last_updated":"2026-07-25T03:45:26Z","snapshot_observed_at":"2026-08-01T15:04:25.301340Z","submitted_at":"2026-07-21T00:17:55Z","title":"A Self-Evolving Default Action for Cooperative Tasks with Continuous Action Space","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-01T15:04:29.757511Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2607.18597"},"observation_digest":"sha256:2ce36c2ac477c64df7d4a56426a5b82a5d30a28f7e0c88f506ab216bc6422bb8","observation_id":"7612fb09-f881-420a-8cd6-d4d5effcc29a","resolution":{"observed_at":"2026-08-01T15:04:29.757511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-08-01T01:39:36.573052Z","title":"Value-decomposition networks for cooperative multi-agent learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.25754","last_updated":"2026-07-28T14:16:11Z","snapshot_observed_at":"2026-08-03T10:04:42.785703Z","submitted_at":"2026-07-28T14:16:11Z","title":"Cooperative Multi-UAV Navigation in Complex Environments via Systematic Multi-Agent Deep Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T01:39:36.573052Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2607.25754"},"observation_digest":"sha256:45c1d9242711935fff6f1025382abaa2d71c680f59b1e830d8fc14b73889e9a3","observation_id":"335a733d-2574-476b-8628-e046ddf9749b","resolution":{"observed_at":"2026-08-01T01:39:36.573052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-31T21:55:17.256914Z","title":"arXiv preprint arXiv:1706.05296 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27967","last_updated":"2026-07-30T10:14:24Z","snapshot_observed_at":"2026-08-03T21:43:44.900041Z","submitted_at":"2026-07-30T10:14:24Z","title":"MARS-RA: Rank Aggregation for Credit Assignment via Multimodal Comparisons in Embodied Multi-Agent Cooperation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-31T21:55:17.256914Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2607.27967"},"observation_digest":"sha256:4068df6b3aa8737ac4d428ac32a8d3311697c858e6b76f29720b5190ca9b53cc","observation_id":"4868a3a0-0b74-4a6d-be4f-e7448f881c8b","resolution":{"observed_at":"2026-07-31T21:55:17.256914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1706.05296/citation-record","integrity":"/paper/1706.05296/integrity","json":"/paper/1706.05296/citation-record.json","paper":"/paper/1706.05296"},"outbound":[],"paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 50 inbound Pith citation observations for arXiv:1706.05296."}