{"as_of":"2026-08-17T12:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:29bb99e8b0cefe0fc66af4e20d764fa2d82b2bf80bd4732ca072274a95c9dede","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:49:45.752819Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-23T03:34:58.917609Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-23T03:35:20.690302Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"cited_work":{"arxiv_id":"1909.02682","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1909.02682","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient communication in multi-agent reinforcement learning via variance based control","venue":null,"work_id":"932daa1c-f2b6-48e6-8145-1e7700ecef1e","year":2019},"citing_paper":{"arxiv_id":"2502.00558","last_updated":"2025-02-13T22:50:50Z","snapshot_observed_at":"2026-08-13T23:51:53.614901Z","submitted_at":"2025-02-01T21:04:32Z","title":"Asynchronous Cooperative Multi-Agent Reinforcement Learning with Limited Communication","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-23T03:34:58.917609Z"},"links":{"cited_paper":"/paper/1909.02682","citing_paper":"/paper/2502.00558"},"observation_digest":"sha256:4e1a85d23898716e23b1dce50e5ffeac8e4a101beccd3c99745e754111714ec3","observation_id":"39a75619-aa1d-4b7d-a6db-52babe566723","resolution":{"observed_at":"2026-05-23T03:35:20.692764Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1909.02682/citation-record","integrity":"/paper/1909.02682/integrity","json":"/paper/1909.02682/citation-record.json","paper":"/paper/1909.02682"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:49:46.159297Z","title":null,"venue":null,"work_id":"44c9d463-b2bb-4dfa-a3c8-4eeb4ecb97e1","year":null},"citing_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T04:49:45.636500Z"},"links":{"citing_paper":"/paper/1909.02682"},"observation_digest":"sha256:c66efc9772f1c10037ba18929704485d110eb9181f39e30fbb390c0ddafa1bbb","observation_id":"b28e4345-ec64-4f6a-a45d-819c54f546e4","resolution":{"observed_at":"2026-08-14T04:49:46.164073Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:49:46.143111Z","title":null,"venue":null,"work_id":"f0f18122-d930-453f-8666-23403e610009","year":null},"citing_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T04:49:45.641996Z"},"links":{"citing_paper":"/paper/1909.02682"},"observation_digest":"sha256:84e2eb9428f6d3892bc00969ce81dd21ddd6a2d5b0d96e49baa5da4e1e52c88d","observation_id":"da3fdb1f-c230-48b0-99dd-a878cac82540","resolution":{"observed_at":"2026-08-14T04:49:46.148848Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:49:46.127230Z","title":"For all the six battles, each allied or enemy agent has a sight range of 9 and shooting range of 6 for all types of agents","venue":null,"work_id":"42631a5d-5e2d-41d5-8e50-5fff0d3e5cb7","year":null},"citing_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T04:49:45.646826Z"},"links":{"citing_paper":"/paper/1909.02682"},"observation_digest":"sha256:81c53b8e0ddd63ced3b868baf5056ec1c3a6bfdae75396fe26755c18f76cd6bb","observation_id":"09a53e5c-f1ba-4fe5-bb5e-028adf35644b","resolution":{"observed_at":"2026-08-14T04:49:46.133151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:49:46.112454Z","title":null,"venue":null,"work_id":"213a9681-66b3-45c7-8a30-e9e85351a904","year":null},"citing_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T04:49:45.652003Z"},"links":{"citing_paper":"/paper/1909.02682"},"observation_digest":"sha256:44f78347f5c6dcf2c5c0f685d1c8530016f290904f39af46d5c53bce9dd2aa3e","observation_id":"54736b68-58d4-40a4-adb8-0a648b36d465","resolution":{"observed_at":"2026-08-14T04:49:46.117242Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:49:46.095894Z","title":null,"venue":null,"work_id":"253952b0-1829-44c6-8d60-0901682bcbe2","year":null},"citing_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T04:49:45.657669Z"},"links":{"citing_paper":"/paper/1909.02682"},"observation_digest":"sha256:4abcbf229f6cbd344e3f4906b387a54d0354ce5ea7af94fe55d0d49b853c0ad4","observation_id":"c31b94b7-59fa-46ba-872b-6f7c5794ad0b","resolution":{"observed_at":"2026-08-14T04:49:46.101637Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:49:46.081183Z","title":"Foerster, I","venue":null,"work_id":"32bc9ac5-f2e1-4215-a25e-12201900a15a","year":2016},"citing_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T04:49:45.662487Z"},"links":{"citing_paper":"/paper/1909.02682"},"observation_digest":"sha256:1cd1ae62a4ef6392663813ac2f22a6d63bd84c757f3c5f5710fc4e0226609dd0","observation_id":"086d05f4-76ed-4e2c-a1cd-3250e81c86ae","resolution":{"observed_at":"2026-08-14T04:49:46.086026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.11702","last_updated":"2020-01-11T22:42:13Z","snapshot_observed_at":"2026-08-15T10:40:16.044742Z","submitted_at":"2018-10-27T20:45:19Z","title":"Multi-Agent Common Knowledge Reinforcement Learning","version":8},"cited_work":{"arxiv_id":"1810.11702","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.11702","snapshot_observed_at":"2026-08-14T04:49:45.893185Z","title":"Multi-Agent Common Knowledge Reinforcement Learning","venue":"cs.MA","work_id":"620a9a8b-c7ae-4bba-9908-0bd374696c11","year":2018},"citing_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T04:49:45.667180Z"},"links":{"cited_paper":"/paper/1810.11702","citing_paper":"/paper/1909.02682"},"observation_digest":"sha256:c05ae2c2d1404b9b40de5b927560cd898b01b8559873ba06f2e5f256253148d9","observation_id":"47112537-6d86-4658-a4cb-9fb42e56f93d","resolution":{"observed_at":"2026-08-14T04:49:45.899924Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:49:46.065906Z","title":null,"venue":null,"work_id":"7a3f1683-cb5b-423a-a287-79964459b661","year":2018},"citing_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T04:49:45.672803Z"},"links":{"citing_paper":"/paper/1909.02682"},"observation_digest":"sha256:9f003e0dade28fd47d85e0434392bd1c40bdec3220d251c4e2c77bf92220330f","observation_id":"db577a98-78c4-4d99-9178-46664de377c8","resolution":{"observed_at":"2026-08-14T04:49:46.071079Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:49:46.051126Z","title":"Hausknecht and P","venue":null,"work_id":"6eca21fe-7d04-46e3-8521-959754424786","year":2015},"citing_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T04:49:45.677261Z"},"links":{"citing_paper":"/paper/1909.02682"},"observation_digest":"sha256:b39c280b5f6a921d4d007c36a94782f0f1940de2a2e454f8342dc803af9eda88","observation_id":"2a8ee9b5-cb84-4513-865f-5077d372ffb8","resolution":{"observed_at":"2026-08-14T04:49:46.055816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:49:46.035726Z","title":"Jiang and Z","venue":null,"work_id":"4111103f-8a45-46b6-94f0-63093e1ddf7b","year":2018},"citing_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T04:49:45.681782Z"},"links":{"citing_paper":"/paper/1909.02682"},"observation_digest":"sha256:054c29827fb1561eaf1fb1d3605b366a2f221101190895168d8a7a2d0b138b0a","observation_id":"290f1f12-b250-4af8-a2d1-01db548bb76c","resolution":{"observed_at":"2026-08-14T04:49:46.041041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.01554","last_updated":"2019-02-05T05:51:36Z","snapshot_observed_at":"2026-08-14T17:20:57.954108Z","submitted_at":"2019-02-05T05:51:36Z","title":"Learning to Schedule Communication in Multi-agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.01554","snapshot_observed_at":"2026-08-14T04:49:45.687319Z","title":null,"venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T04:49:45.687319Z"},"links":{"cited_paper":"/paper/1902.01554","citing_paper":"/paper/1909.02682"},"observation_digest":"sha256:38a7fe5f9f635ad4d535036c25e3060a7ef5a64adadadc28a5c3df4cc6ea77bb","observation_id":"b01ba1db-44e0-4f8d-b346-74d5a4d34965","resolution":{"observed_at":"2026-08-14T04:49:45.687319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:49:46.020618Z","title":"reinforcement learning in robotics: A survey","venue":null,"work_id":"fc77c6f9-8a64-4a38-9e2e-72567acf68e9","year":2013},"citing_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T04:49:45.693062Z"},"links":{"citing_paper":"/paper/1909.02682"},"observation_digest":"sha256:1be45ef6dbfd6b050d99afbf60c7692d18f65752f2ed947bb39cf5336738caa5","observation_id":"267539ea-9e01-4482-a8fb-678f265fb0a3","resolution":{"observed_at":"2026-08-14T04:49:46.025786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:49:46.005922Z","title":null,"venue":null,"work_id":"2e9d9f18-6504-410b-ba8c-7cac407041fb","year":2017},"citing_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T04:49:45.697443Z"},"links":{"citing_paper":"/paper/1909.02682"},"observation_digest":"sha256:f9d0c5f501920e96d63d4d7069c5a52d63ae090aa1ae5d2484d7c40f20723151","observation_id":"efd11a8a-f42a-4bb6-910a-949dea82e9f5","resolution":{"observed_at":"2026-08-14T04:49:46.010603Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:49:45.989984Z","title":"a uniﬁed game-theoretic approach to multiagent reinforcement learning","venue":null,"work_id":"4c491f7d-b29a-47fc-9f36-2a2a8ec0d421","year":2017},"citing_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T04:49:45.701661Z"},"links":{"citing_paper":"/paper/1909.02682"},"observation_digest":"sha256:8d710387354e473beb022b4dd0f15a6101a48a236c78338c10e2ff2576d1ac30","observation_id":"957c2a5f-f798-443f-b951-dd9de0d44498","resolution":{"observed_at":"2026-08-14T04:49:45.995793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-14T03:19:40.736445Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-14T04:49:45.706096Z","title":"playing atari with deep reinforcement learning","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T04:49:45.706096Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/1909.02682"},"observation_digest":"sha256:8cefa52a072260af65bda58273e3aba535d779b73e6a1ba9f1725a858c6f57b1","observation_id":"b3ee8536-dc2c-492e-a8b5-65a973ff6df1","resolution":{"observed_at":"2026-08-14T04:49:45.706096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.10069","last_updated":"2017-09-14T12:45:46Z","snapshot_observed_at":"2026-08-14T21:09:23.651989Z","submitted_at":"2017-03-29T14:37:25Z","title":"Multiagent Bidirectionally-Coordinated Nets: Emergence of Human-level Coordination in Learning to Play StarCraft Combat Games","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.10069","snapshot_observed_at":"2026-08-14T04:49:45.710959Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T04:49:45.710959Z"},"links":{"cited_paper":"/paper/1703.10069","citing_paper":"/paper/1909.02682"},"observation_digest":"sha256:b9003814af6dbbf5a57989bb7e83d313c533a64b19505beb36eda497f3a61930","observation_id":"fcae593e-bdc7-47c9-86ac-051aa53a5087","resolution":{"observed_at":"2026-08-14T04:49:45.710959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.11485","last_updated":"2018-06-06T17:58:09Z","snapshot_observed_at":"2026-08-14T19:30:41.502606Z","submitted_at":"2018-03-30T14:23:39Z","title":"QMIX: Monotonic Value Function Factorisation for Deep Multi-Agent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.11485","snapshot_observed_at":"2026-08-14T04:49:45.715818Z","title":"Rashid, M","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T04:49:45.715818Z"},"links":{"cited_paper":"/paper/1803.11485","citing_paper":"/paper/1909.02682"},"observation_digest":"sha256:92428e5005fb0a2aeeab4723f3afd6a261b69dac53e1b12b5488860704b01926","observation_id":"4a5efe84-fddf-4909-9802-9cb9f4dbdee1","resolution":{"observed_at":"2026-08-14T04:49:45.715818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-14T17:37:44.544678Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-14T04:49:45.720603Z","title":"Samvelyan, T","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T04:49:45.720603Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/1909.02682"},"observation_digest":"sha256:85c96cbb229c669bea07e71bb78d2354227cc4fba4f0dbdc1d8e0ba62e0cc277","observation_id":"fb972503-c080-4d04-af4a-b562473bca29","resolution":{"observed_at":"2026-08-14T04:49:45.720603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.03295","last_updated":"2016-10-11T12:09:03Z","snapshot_observed_at":"2026-08-14T21:35:45.210326Z","submitted_at":"2016-10-11T12:09:03Z","title":"Safe, Multi-Agent, Reinforcement Learning for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.03295","snapshot_observed_at":"2026-08-14T04:49:45.725524Z","title":"safe, multi-agent, reinforcement learning for autonomous driving","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T04:49:45.725524Z"},"links":{"cited_paper":"/paper/1610.03295","citing_paper":"/paper/1909.02682"},"observation_digest":"sha256:45eb4cb368cff7a38f95e09365bd79f7e448ee07241af6e64a467ce49121ea16","observation_id":"1aceee9f-2bf0-44b1-bbef-cf280b945984","resolution":{"observed_at":"2026-08-14T04:49:45.725524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:49:45.972914Z","title":"Sukhbaatar, R","venue":null,"work_id":"2c68bd83-c8d5-4a12-9e6b-f92ac4e09b32","year":2016},"citing_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T04:49:45.730449Z"},"links":{"citing_paper":"/paper/1909.02682"},"observation_digest":"sha256:3b33bcaa51298c65007e85fc86665cfab23170cebb9b2b0409442d1ab4d02527","observation_id":"d00263c5-79ec-4839-9737-a6846614e410","resolution":{"observed_at":"2026-08-14T04:49:45.978152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-08-14T20:53:35.783079Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-08-14T04:49:45.734868Z","title":"Sunehag, G","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T04:49:45.734868Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/1909.02682"},"observation_digest":"sha256:1a81b7dd03243c380e0653d8e6d0027e4d738ec23c116ba15ca0b42b5d59b6a6","observation_id":"b5917d2a-06e3-47af-815b-ae0c258b0cef","resolution":{"observed_at":"2026-08-14T04:49:45.734868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:49:45.957487Z","title":"Tampuu, T","venue":null,"work_id":"c8343ad6-8aad-4626-b548-3abaaff6cfad","year":2017},"citing_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T04:49:45.739440Z"},"links":{"citing_paper":"/paper/1909.02682"},"observation_digest":"sha256:767c8cb2ac8b79e4f603118a7f72280894c8b6471a895e0d84c86268ab79ef6e","observation_id":"697a7f96-94ce-4519-9767-5c86393839f4","resolution":{"observed_at":"2026-08-14T04:49:45.962428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:49:45.941397Z","title":"multi-agent reinforcement learning: Independent vs. cooperative agents","venue":null,"work_id":"a7cc8242-d87f-4c94-9c55-661776a7fa90","year":1993},"citing_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T04:49:45.743834Z"},"links":{"citing_paper":"/paper/1909.02682"},"observation_digest":"sha256:e612836bc58bcbcc047dc6596b415bf2c0452b9247205b2ece3ce7527f0dbc8c","observation_id":"74c31445-a4af-41dc-98f5-5c3d97e89650","resolution":{"observed_at":"2026-08-14T04:49:45.947300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:49:45.926415Z","title":"Jaakkola, M","venue":null,"work_id":"ed103a30-f162-40f6-90e6-aabefba973dc","year":1994},"citing_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T04:49:45.748220Z"},"links":{"citing_paper":"/paper/1909.02682"},"observation_digest":"sha256:f39c94c89ae23e2336cb4e5aa4842a3af1e8a9b90f8da53038b0ff78c4a15206","observation_id":"b9c0bea8-9c07-4f2f-a9d8-9a68859c3023","resolution":{"observed_at":"2026-08-14T04:49:45.930975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:49:45.910856Z","title":null,"venue":null,"work_id":"3afdf7ee-9539-4829-88b8-2a6abf63a873","year":2001},"citing_paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T04:49:45.752819Z"},"links":{"citing_paper":"/paper/1909.02682"},"observation_digest":"sha256:9346c665fdb24a6918589dd3d8ecb31bc53f87aade8da3cdd69341a19603c436","observation_id":"84f591b3-4679-4d0b-be52-f9b65e6ade7f","resolution":{"observed_at":"2026-08-14T04:49:45.916388Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1909.02682","last_updated":"2019-11-01T15:33:40Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T07:10:18.765625Z","submitted_at":"2019-09-06T00:26:05Z","title":"Efficient Communication in Multi-Agent Reinforcement Learning via Variance Based Control"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":1,"verified_fuzzy":10},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 1 inbound Pith citation observation for arXiv:1909.02682."}