{"as_of":"2026-08-15T11:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fd2cf8118ffe1b1f40a6da7521e6c388a8d41a8445990460c3d591e5d722a9cc","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T13:05:56.319110Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.06758/citation-record","integrity":"/paper/1908.06758/integrity","json":"/paper/1908.06758/citation-record.json","paper":"/paper/1908.06758"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:05:56.671656Z","title":"A concise introduction to multiagent systems and distributed arti/f_icial intelligence.Synthesis Lectures on Arti/f_icial Intelligence and Machine Learning, 1(1):1–71, 2007","venue":null,"work_id":"299eff9e-6f47-4447-9bbb-7f0931210e21","year":2007},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.207522Z"},"links":{"citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:39b6401543b61d5ad7c8925a3830d076dc1a1f48d22e8bd52de35b3c905a4d9f","observation_id":"75822514-1ad5-409a-9682-e54421c15dd4","resolution":{"observed_at":"2026-08-14T13:05:56.676535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:05:56.658907Z","title":"Multiagent systems: A survey from a machine learning perspective","venue":null,"work_id":"7b2ec803-88fb-4f68-9fe7-9ea28c7c707a","year":2000},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.211794Z"},"links":{"citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:1411f7f9be14ab88283e0549d519f3e153a992b5b0b479a60b95fe500b681858","observation_id":"860b8e76-a03e-4a3c-a536-9328dd2945b4","resolution":{"observed_at":"2026-08-14T13:05:56.663104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:05:56.647168Z","title":"Multiagent systems: a modern approach to distributed arti/f_icial intelligence","venue":null,"work_id":"491b3fad-51d4-4e12-809a-cfac0119d36f","year":1999},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.215996Z"},"links":{"citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:2c182813414af592a09c658cf0c9f154260a7eb965eabbe9809a8f38d53d14f9","observation_id":"01522112-b185-438f-b35f-e04cf9c63c92","resolution":{"observed_at":"2026-08-14T13:05:56.651282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:05:56.633754Z","title":"Re- inforcement learning for cooperating and communicating reactive agents in electrical power grids","venue":null,"work_id":"a2537b5e-7bfa-433b-aaa6-a23c75bb0ea4","year":2000},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.219765Z"},"links":{"citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:96ad3af406dadbc9c08d84e802513bcead9e3ab6c924aafff94284d0dc55b14b","observation_id":"28143364-de4e-471b-8e1b-3facf58feae3","resolution":{"observed_at":"2026-08-14T13:05:56.638690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:05:56.622049Z","title":"Game theory and multi-agent reinforcement learning","venue":null,"work_id":"2e8a455e-a0dd-4961-85be-991ec3ae97d5","year":2012},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.224039Z"},"links":{"citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:b71d79b9a5173db8bf63ce59b8b9ca4d620ca214a4a8189561e149aafd166222","observation_id":"d9b48a66-3725-4483-9e33-cc912b4d3987","resolution":{"observed_at":"2026-08-14T13:05:56.626137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:05:56.610592Z","title":"Multi-agent reinforcement learning: An overview","venue":null,"work_id":"e4307cd9-bd41-4a21-a809-4052c37201a2","year":2010},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.229834Z"},"links":{"citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:efee952c071e78de39396422f77b1ddde6981d19b93e0b87f7984d535a7b32bd","observation_id":"3b7fb27f-9dca-4f8c-a32d-14e92f75e31e","resolution":{"observed_at":"2026-08-14T13:05:56.614681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:05:56.234530Z","title":"Reinforcement learn- ing: An introduction","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.234530Z"},"links":{"citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:9d27197b4586e9672a64b86b81f9b91418265d760d4aef69663fcf19e42a7293","observation_id":"13330b69-48be-42fc-bbde-c65c44956eb6","resolution":{"observed_at":"2026-08-14T13:05:56.234530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:05:56.591531Z","title":"Markov games as a framework for multi- agent reinforcement learning","venue":null,"work_id":"b50f3835-0ba1-440f-bbac-04359dd48844","year":1994},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.238392Z"},"links":{"citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:757457a72b3c5f119a51da0cf64c6690ed8253146db9c59b6991177a462004bf","observation_id":"48b12369-703f-4d31-a9f9-58f55ddc59db","resolution":{"observed_at":"2026-08-14T13:05:56.595729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:05:56.580151Z","title":"Nash q-learning for general-sum stochastic games","venue":null,"work_id":"962eff26-8722-4a2d-9ff7-1109ed03f29d","year":2003},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.242429Z"},"links":{"citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:450db9d69119ba02d554ab3ef457fb93104341451529a81daeed17832710d46e","observation_id":"30c51125-48f6-42f8-9ca8-f5a80727d9ff","resolution":{"observed_at":"2026-08-14T13:05:56.584260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.10069","last_updated":"2017-09-14T12:45:46Z","snapshot_observed_at":"2026-08-14T21:09:23.651989Z","submitted_at":"2017-03-29T14:37:25Z","title":"Multiagent Bidirectionally-Coordinated Nets: Emergence of Human-level Coordination in Learning to Play StarCraft Combat Games","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.10069","snapshot_observed_at":"2026-08-14T13:05:56.246293Z","title":"Multiagent bidirectionally-coordinated nets: Emergence of human-level coordination in learning to play starcraft combat games","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.246293Z"},"links":{"cited_paper":"/paper/1703.10069","citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:00c97b2c7cbfd65606abd089b946bc8a4921efe0f25eef1d5b18f493ca685bb3","observation_id":"dce179ef-6693-4d4b-bdde-3485763441b9","resolution":{"observed_at":"2026-08-14T13:05:56.246293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:05:56.250548Z","title":"Generative adversarial nets","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.250548Z"},"links":{"citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:f547761d6195f3653e4ca8d16109aeb0f8fcf7c29159a7eca42bd27041a689de","observation_id":"eb0950f4-b9b9-47cd-b3c2-537247efa11a","resolution":{"observed_at":"2026-08-14T13:05:56.250548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:05:56.562293Z","title":"Continual lifelong learning with neural networks: A review","venue":null,"work_id":"63f3c016-45bb-480f-8de7-207d8a78c0bd","year":2019},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.254548Z"},"links":{"citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:15cbe35261d306dfa6f3f349b8ea9225e7fdd4fe4f0d2887b60f93bc62969534","observation_id":"a512184e-d9f4-4ae5-8e27-41695822ae73","resolution":{"observed_at":"2026-08-14T13:05:56.566119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:05:56.550642Z","title":"Multi-agent actor-critic for mixed cooperative-competitive environments","venue":null,"work_id":"b24b7cf1-7eb6-4f44-b244-db8d4c9eed03","year":2017},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.259930Z"},"links":{"citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:1c6ee15c6cb4e21ba04417cab6bb589f4d8bccbf17edc86dc596278a53d72695","observation_id":"1201e5d3-273e-4cc2-b5ca-4d0bccbe69a8","resolution":{"observed_at":"2026-08-14T13:05:56.554522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:05:56.539594Z","title":"Partially observable markov decision processes for spoken dialog systems","venue":null,"work_id":"8bd305b9-53d1-4cbb-8207-b04d6bd7ba0b","year":2007},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.263645Z"},"links":{"citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:357102cb1888127331ebf8a853bf2ad43248784915f4e207b4309901abb4981f","observation_id":"c94f8fb8-6780-4a0c-bc11-634adc7ac514","resolution":{"observed_at":"2026-08-14T13:05:56.543604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:05:56.527870Z","title":"Multi-agent reinforcement learning: Independent vs","venue":null,"work_id":"03ea9ef3-ece2-46cb-ad21-f20097019781","year":1993},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.267278Z"},"links":{"citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:c13c6b671765c3734abc4ae7c34c7db66fd22fdf62967323815755cd64e6c092","observation_id":"73a311e6-3bc4-40de-8d3e-6d99a0ac366c","resolution":{"observed_at":"2026-08-14T13:05:56.532012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:05:56.270771Z","title":"Q-learning","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.270771Z"},"links":{"citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:d040d83173ffada36d384f6903f9c669b64e0d4045cf3eb9418374de67bcb208","observation_id":"9b8427b5-fbb2-43f8-9c94-ddd801035f4f","resolution":{"observed_at":"2026-08-14T13:05:56.270771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:05:56.507137Z","title":"Op- timal and approximate q-value functions for decentralized pomdps","venue":null,"work_id":"ecd0a863-a033-45a5-b25d-c9b146df1670","year":2008},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.274317Z"},"links":{"citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:90a2976b928f61d23ab5d8633346c5cdb568c142c7b9939519b473ce0af6c13e","observation_id":"97d01195-3dfa-4614-97f7-87c9149c18a1","resolution":{"observed_at":"2026-08-14T13:05:56.512053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-14T13:05:56.277833Z","title":"Continuous control with deep reinforcement learning","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.277833Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:d19c7b3d575de7b988fa885e0d11fdfdf0a7e8dc60e1f441b20b6c8356566e53","observation_id":"4104dd0f-4a28-46b4-834c-f082fa1f79db","resolution":{"observed_at":"2026-08-14T13:05:56.277833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-08-14T20:53:35.783079Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-08-14T13:05:56.281813Z","title":"Value-decomposition networks for cooperative multi-agent learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.281813Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:340335336c74f12fa6166de11387df08de100232964e1181da6dd95cb1886c6e","observation_id":"8b9d841f-e227-4eda-bc63-32f656b4c283","resolution":{"observed_at":"2026-08-14T13:05:56.281813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.11485","last_updated":"2018-06-06T17:58:09Z","snapshot_observed_at":"2026-08-14T19:30:41.502606Z","submitted_at":"2018-03-30T14:23:39Z","title":"QMIX: Monotonic Value Function Factorisation for Deep Multi-Agent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.11485","snapshot_observed_at":"2026-08-14T13:05:56.285822Z","title":"Qmix: Monotonic value function factorisation for deep multi-agent reinforcement learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.285822Z"},"links":{"cited_paper":"/paper/1803.11485","citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:57d8896fd1dcf38f0951473c1d0b74229a0180aae4edb90670d7f7fa42da4eec","observation_id":"1db650e1-fcdc-44df-9d33-ff776325af01","resolution":{"observed_at":"2026-08-14T13:05:56.285822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:05:56.493577Z","title":"Counterfactual multi-agent policy gradients","venue":null,"work_id":"d42d37e9-5942-4ffe-854e-085973cc644f","year":2018},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.289877Z"},"links":{"citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:08259a11537efd4a04120fcf334acb8a08624923f77160e6a52f50ab9121e920","observation_id":"58ad3c4c-d309-4362-a885-ec3fbd27854d","resolution":{"observed_at":"2026-08-14T13:05:56.498499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.07297","last_updated":"2018-12-18T11:08:31Z","snapshot_observed_at":"2026-08-15T00:48:28.919466Z","submitted_at":"2018-12-18T11:08:31Z","title":"Continual Match Based Training in Pommerman: Technical Report","version":1},"cited_work":{"arxiv_id":"1812.07297","doi":null,"metadata_source":"pith","pith_arxiv_id":"1812.07297","snapshot_observed_at":"2026-08-14T13:05:56.384072Z","title":"Continual Match Based Training in Pommerman: Technical Report","venue":"cs.AI","work_id":"281e656b-6d5f-42b6-9a25-d3fa42bb59ed","year":2018},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.293807Z"},"links":{"cited_paper":"/paper/1812.07297","citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:d612945ceba7ee05c1ab23cd31619fa70af6aa4980cc2e6d4c1b4ba9d1e7af36","observation_id":"88ba8e82-9709-4fce-9514-43af7384a78f","resolution":{"observed_at":"2026-08-14T13:05:56.390291Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.01281","last_updated":"2018-07-03T16:57:18Z","snapshot_observed_at":"2026-08-14T18:56:05.414835Z","submitted_at":"2018-07-03T16:57:18Z","title":"Human-level performance in first-person multiplayer games with population-based deep reinforcement learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.01281","snapshot_observed_at":"2026-08-14T13:05:56.297694Z","title":"Human-level performance in /f_irst-person multiplayer games with population-based deep reinforcement learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.297694Z"},"links":{"cited_paper":"/paper/1807.01281","citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:7a00b4a0581ddfb01f2a912993d03859e831cf003a8814197ecc588f258549ad","observation_id":"b187f6ad-70a9-4960-9cba-4be3b72e6743","resolution":{"observed_at":"2026-08-14T13:05:56.297694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.09846","last_updated":"2017-11-28T16:16:21Z","snapshot_observed_at":"2026-08-15T05:47:29.683783Z","submitted_at":"2017-11-27T17:33:27Z","title":"Population Based Training of Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.09846","snapshot_observed_at":"2026-08-14T13:05:56.301394Z","title":"Popu- lation based training of neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.301394Z"},"links":{"cited_paper":"/paper/1711.09846","citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:1f648ff31374c4f880d818f6a5919323255369ca2e70cd5d37d46954c2a6c572","observation_id":"8a726443-d11b-40f4-99d2-2f7353077062","resolution":{"observed_at":"2026-08-14T13:05:56.301394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:05:56.481182Z","title":"A generalized dynamic programming princi- ple and hamilton-jacobi-bellman equation","venue":null,"work_id":"b867f558-f06c-4409-94c7-f6a8c963e8d4","year":1992},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.305109Z"},"links":{"citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:5e6e2c3ec73b9c9f2ecea348c1c8f986583ab791eae1c68adece266fb4fe4010","observation_id":"b7ceb260-8f06-42df-8d37-126c442e07f2","resolution":{"observed_at":"2026-08-14T13:05:56.485220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:05:56.469359Z","title":"Convex optimiza- tion","venue":null,"work_id":"23656daa-9e60-4aa5-aad2-fa0d9afe4c60","year":2004},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.308534Z"},"links":{"citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:717ff4a5f199e50d9fe182ef8345ac7082eee5f5c11604749d88801980fba528","observation_id":"888616d8-b9da-4e97-84f9-4df4ee1b17cc","resolution":{"observed_at":"2026-08-14T13:05:56.473885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:05:56.456006Z","title":"Policy gradient methods for reinforcement learning with function approximation","venue":null,"work_id":"ea6a1fa6-6548-4f3b-bb42-fd3acf28935a","year":2000},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.311931Z"},"links":{"citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:ec4c4740f8a389e997ecff8dcda6535259b4762b0e2e485454442c8c5a37148f","observation_id":"8f86083c-fb7e-49f6-9cb3-30dfeb4c2df3","resolution":{"observed_at":"2026-08-14T13:05:56.460617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1701.07875","last_updated":"2017-12-06T20:01:54Z","snapshot_observed_at":"2026-08-14T21:19:18.245847Z","submitted_at":"2017-01-26T21:10:29Z","title":"Wasserstein GAN","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.07875","snapshot_observed_at":"2026-08-14T13:05:56.315578Z","title":"Wasserstein gan","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.315578Z"},"links":{"cited_paper":"/paper/1701.07875","citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:c1258bac4d83036588f88c1cf6e55689a8f96a5d4b55c2596451588a2c789ed6","observation_id":"35bf0017-7a5f-4a1a-aa2e-8d1faf32d5f7","resolution":{"observed_at":"2026-08-14T13:05:56.315578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:05:56.443459Z","title":"Improved training of wasserstein gans","venue":null,"work_id":"a8758f66-90d3-4186-a0f9-77f63c572300","year":2017},"citing_paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T13:05:56.319110Z"},"links":{"citing_paper":"/paper/1908.06758"},"observation_digest":"sha256:a7f932d463818a7495075e9841d72ec40332b395ebbb67455f1e26595d7ac0ef","observation_id":"c8e541bb-16ba-499f-ba0b-32e3f42d7ee1","resolution":{"observed_at":"2026-08-14T13:05:56.447835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.06758","last_updated":"2019-08-16T07:39:59Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T05:48:07.346494Z","submitted_at":"2019-08-16T07:39:59Z","title":"Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":1,"verified_fuzzy":18},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:1908.06758."}