{"as_of":"2026-08-18T01:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:30d336dc3292ff4dd82a9f27d0dd361280ba2000c095684871a06e09bc39aaf5","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:20:45.426207Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.18333/citation-record","integrity":"/paper/2507.18333/integrity","json":"/paper/2507.18333/citation-record.json","paper":"/paper/2507.18333"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:46.553447Z","title":"Autonomous agents modelling other agents: A comprehensive survey and open problems","venue":null,"work_id":"79457797-f951-41c4-86d5-2b2accfcc292","year":2018},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.070848Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:8726e9ad8ed947d6f9a04a941caf6a1e06506b66cb40bda25778de185cdceadc","observation_id":"c4fa5e91-f1d6-45c6-86fc-945723ea4e3a","resolution":{"observed_at":"2026-08-15T18:20:46.570620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:46.531662Z","title":"Albrecht, Filippos Christianos, and Lukas Sch\\\"afer","venue":null,"work_id":"c7c76877-cdec-4594-b306-e01a7cbf7da2","year":2024},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.083380Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:d1bb1466724c5c6161480a78a9d1cd7e0819d69318ed0bd1d3627601aa3701ee","observation_id":"968dbb79-5f4f-43af-9998-6769f5324cf0","resolution":{"observed_at":"2026-08-15T18:20:46.537761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:46.496601Z","title":"Optimal control of M arkov processes with incomplete state information","venue":null,"work_id":"b11f7b1b-deb2-43ad-b1b1-243ad0b8101a","year":1965},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.093823Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:ea1fcface775357a8289008cce051b2adbb2b47671ad89382d3a9f8d986d6657","observation_id":"540b63bb-d6bb-4ac2-ac8c-5c86412e4a62","resolution":{"observed_at":"2026-08-15T18:20:46.509296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:45.098662Z","title":"The hanabi challenge: A new frontier for ai research","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.098662Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:c45822d9316d44cb07768c1d9b006f47ecf00e468adf69c2f22dad27577ca98f","observation_id":"40d5592a-1926-4508-b5b6-acd85a12b731","resolution":{"observed_at":"2026-08-15T18:20:45.098662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:46.435568Z","title":"The complexity of decentralized control of markov decision processes","venue":null,"work_id":"ec41bcac-83da-4ca9-8740-aefc9111180a","year":2002},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.105513Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:75e0fcb3958b41b4a9cea256cdc21486cdaea6d703caa9300cc79d5105113bdf","observation_id":"44b23c26-441a-41ba-bf1c-212456047777","resolution":{"observed_at":"2026-08-15T18:20:46.444200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-16T19:04:51.053420Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-15T18:20:45.124963Z","title":"Is independent learning all you need in the starcraft multi-agent challenge? arXiv preprint arXiv:2011.09533, 2020","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.124963Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:4693fbb0aeec71eb012937b99051c700825677922982b0fa9dfe299a52d9a336","observation_id":"1bdcf2c9-902d-456a-b0ff-2098cb75461e","resolution":{"observed_at":"2026-08-15T18:20:45.124963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:46.398436Z","title":"Smacv2: An improved benchmark for cooperative multi-agent reinforcement learning","venue":null,"work_id":"279a9b93-c529-46cb-9772-61886b9212e7","year":2023},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.134830Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:dfe57606852e3c79d845827e6d634133947790c9ebac54ce1980fb4fa29cc924","observation_id":"767b0a5c-831e-4cfd-8332-42004233aeec","resolution":{"observed_at":"2026-08-15T18:20:46.406440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:46.359669Z","title":"Bayesian action decoder for deep multi-agent reinforcement learning","venue":null,"work_id":"49ba0b23-d1a0-48fc-82ff-9c342e12c8b9","year":1942},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.142457Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:fde2dcdee2506957da9d1927b0197411619e8917c10afc6ff22bf9da252f9576","observation_id":"9318dc74-91e6-4a2c-989f-9a8ce814a138","resolution":{"observed_at":"2026-08-15T18:20:46.376813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06343","last_updated":"2025-03-31T14:56:08Z","snapshot_observed_at":"2026-08-16T12:51:53.701295Z","submitted_at":"2025-03-08T21:29:20Z","title":"Studying the Interplay Between the Actor and Critic Representations in Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06343","snapshot_observed_at":"2026-08-15T18:20:45.151102Z","title":"Studying the interplay between the actor and critic representations in reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.151102Z"},"links":{"cited_paper":"/paper/2503.06343","citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:074f898cf1a258561ff631f1c764f9927bc3c2e6887df5a9f8947361e0a58598","observation_id":"9803b937-1ae1-49e1-b051-92f459b39cb4","resolution":{"observed_at":"2026-08-15T18:20:45.151102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:46.331988Z","title":"Deep recurrent q-learning for partially observable mdps","venue":null,"work_id":"92619d49-9bf7-4d71-8834-722b3165b751","year":2015},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.158224Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:5d1385b38c8533dc5ace3c2c453e6b7d8119a5d88cf01942232b826a87ba3789","observation_id":"9e07b5b1-b7f7-478c-b092-f0762c3bc2e0","resolution":{"observed_at":"2026-08-15T18:20:46.340119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:46.280974Z","title":"other-play","venue":null,"work_id":"0c8357ea-783d-452e-a33a-231923f2a68f","year":2020},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.169641Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:fb51a6d11ade0c8444188b440862038c75483fb3742c5baea3818e8ef7f85fe5","observation_id":"508e3ad0-4800-4341-9f31-13c702551081","resolution":{"observed_at":"2026-08-15T18:20:46.302156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:46.245129Z","title":"Off-belief learning","venue":null,"work_id":"ae7bdca3-fc10-40a0-8f18-70b2c1ff811a","year":2021},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.179013Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:ec422521bcc2aa16500a4a5d48ab8eaeac88215993015d1b58ead6ca7e6af7de","observation_id":"961d6cde-5353-416b-91b5-f694ebd03589","resolution":{"observed_at":"2026-08-15T18:20:46.257877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:45.185723Z","title":"Planning and acting in partially observable stochastic domains","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.185723Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:6202c2362146a2caa80d5f0429d7f952dfd7c63150ef47d3467b63dfc5ea4838","observation_id":"d6b2a152-6b39-48f7-8bab-7b0d194a7090","resolution":{"observed_at":"2026-08-15T18:20:45.185723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:45.191290Z","title":"Multi-agent reinforcement learning as a rehearsal for decentralized planning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.191290Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:046f2b716c4dad6d2917d6e5f69c79834ee867788f165e6e4b34f65f01dfeafb","observation_id":"b75f4662-c49c-44a7-af88-7a7ded0a3d0f","resolution":{"observed_at":"2026-08-15T18:20:45.191290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:45.204100Z","title":"Estimating mutual information","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.204100Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:885327b8b78f8b6ed6682e0f4fb3ad72166891aa9a70c16a300970edd940deff","observation_id":"7c522fe2-f1e7-4966-a875-f02cf11c1cc1","resolution":{"observed_at":"2026-08-15T18:20:45.204100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:46.126883Z","title":"Nonapproximability results for partially observable M arkov D ecision P rocesses","venue":null,"work_id":"1845dc39-ad6c-4150-b5f5-ccc27ca48cde","year":2001},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.212871Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:80dd7c496036531f5e59e1ce9de1e3c8c178c250ae273e6a1485b30f8287f6b7","observation_id":"b35c1ed4-a17e-487d-bda5-bd69207728b4","resolution":{"observed_at":"2026-08-15T18:20:46.152383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17323","last_updated":"2025-10-28T00:28:59Z","snapshot_observed_at":"2026-08-15T23:54:14.506266Z","submitted_at":"2025-05-22T22:24:12Z","title":"Partner Modelling Emerges in Recurrent Agents (But Only When It Matters)","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17323","snapshot_observed_at":"2026-08-15T18:20:45.219324Z","title":"Partner modelling emerges in recurrent agents (but only when it matters)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.219324Z"},"links":{"cited_paper":"/paper/2505.17323","citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:eabfb3e6e1b934fd770063e650792cb380d9e1954a03722035fb7c0befd60fb1","observation_id":"65ff5392-b109-466f-9f28-5830e7754f26","resolution":{"observed_at":"2026-08-15T18:20:45.219324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:46.092833Z","title":"Towards few-shot coordination: Revisiting ad-hoc teamplay challenge in the game of hanabi","venue":null,"work_id":"622b48a4-4887-48aa-9516-8dc35c4f6b78","year":2023},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.226642Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:c7411c4dca03bc5411e6db02274d025f83b6b3171bb351793d07f35e59bc86ce","observation_id":"62971bf3-cf82-4957-b1ff-1aa10fd3830f","resolution":{"observed_at":"2026-08-15T18:20:46.100610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:45.236391Z","title":"Optimal and approximate q-value functions for decentralized pomdps","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.236391Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:0ffc997d04432574cb139d16d3ae7ddedfcaf6f79339711f0287c96885875e30","observation_id":"cdacd85c-232d-42b7-834e-ee46f00fa7ad","resolution":{"observed_at":"2026-08-15T18:20:45.236391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:45.250388Z","title":"A concise introduction to decentralized POMDPs, volume 1","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.250388Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:4dfe663cbb4de9f34096b5b488992f5f3cb6c16910a4b53cb9784db9fa1df9d9","observation_id":"163e3c6b-7ab6-4758-b4c4-75978526783a","resolution":{"observed_at":"2026-08-15T18:20:45.250388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:46.036084Z","title":"The complexity of M arkov D ecision P rocesses","venue":null,"work_id":"cac2640e-6287-42cc-9269-02e54947298c","year":1987},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.261928Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:cf55c458822e5f310d8e15fddc5785aa984664e8bdd97ce66775ee74be2a97da","observation_id":"1c593a86-beff-412b-ae42-05b63875bdfb","resolution":{"observed_at":"2026-08-15T18:20:46.046766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07869","last_updated":"2021-11-09T10:42:04Z","snapshot_observed_at":"2026-08-09T21:21:10.717989Z","submitted_at":"2020-06-14T11:22:53Z","title":"Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.07869","snapshot_observed_at":"2026-08-15T18:20:45.269096Z","title":"Benchmarking multi-agent deep reinforcement learning algorithms in cooperative tasks","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.269096Z"},"links":{"cited_paper":"/paper/2006.07869","citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:33992293eb202051ddd1856b645b37567a23661c7571c0efc76ac6fcdf1e0d9b","observation_id":"4dab9ba7-2994-4682-9406-65442990f983","resolution":{"observed_at":"2026-08-15T18:20:45.269096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:45.981647Z","title":"Agent modelling under partial observability for deep reinforcement learning","venue":null,"work_id":"d20ea498-2bcd-40c4-90e1-153823c60aed","year":2021},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.275751Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:d96b3a54bb002dffc1849f9e9033160ea005e8c38d0a424fc28b4404581a93dd","observation_id":"d19a400a-4fe7-4fe0-b2f5-e0dda961b21d","resolution":{"observed_at":"2026-08-15T18:20:46.006244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:45.282696Z","title":"Facmac: Factored multi-agent centralised policy gradients","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.282696Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:524b0095e5afaa59e5653fc5e9e5ee93a7957b4945125179398ea541977c0fb1","observation_id":"2233985a-2caa-4b17-aec3-7f39164ad8bc","resolution":{"observed_at":"2026-08-15T18:20:45.282696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:45.946017Z","title":"Machine theory of mind","venue":null,"work_id":"d97fc1d4-47db-4d80-ad0b-32f1a0a9c6d5","year":2018},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.289933Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:d06cab950ddca76fba9d24e01eba66a3ae970378558d6736a91255d80bd7e402","observation_id":"22717ee6-b952-4100-ae0b-81ab47e12a2e","resolution":{"observed_at":"2026-08-15T18:20:45.955186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:45.307175Z","title":"Mutual information between discrete and continuous data sets","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.307175Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:5f0866accddf4e33c15eb5b3bbfee8ec0b8fb1d0c47ccae8b120bee18a790812","observation_id":"a98797fd-3d9a-44ff-8d22-6ee717188181","resolution":{"observed_at":"2026-08-15T18:20:45.307175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10090","last_updated":"2026-07-04T05:19:25Z","snapshot_observed_at":"2026-08-16T14:42:35.198274Z","submitted_at":"2023-11-16T18:58:43Z","title":"JaxMARL: Multi-Agent RL Environments and Algorithms in JAX","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10090","snapshot_observed_at":"2026-08-15T18:20:45.321654Z","title":"Jaxmarl: Multi-agent rl environments in jax","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.321654Z"},"links":{"cited_paper":"/paper/2311.10090","citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:610682c9e92a0fc268fc1e8f1ad58775776a1b7fcd9c0c4855c53195409533fd","observation_id":"0a8b6e83-a659-49fe-9f1c-cd0166d76ff9","resolution":{"observed_at":"2026-08-15T18:20:45.321654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.04043","last_updated":"2019-12-09T07:26:52Z","snapshot_observed_at":"2026-08-14T17:37:44.544678Z","submitted_at":"2019-02-11T18:43:53Z","title":"The StarCraft Multi-Agent Challenge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.04043","snapshot_observed_at":"2026-08-15T18:20:45.335420Z","title":"The starcraft multi-agent challenge","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.335420Z"},"links":{"cited_paper":"/paper/1902.04043","citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:7c7db89d3c3740cccf9d48691c123e502d49f794e39cd83a8a945cbfccc9f7e1","observation_id":"45ed4b3f-9170-4581-969c-a16ff0bef7a7","resolution":{"observed_at":"2026-08-15T18:20:45.335420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:45.344743Z","title":"Sutton and Andrew G","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.344743Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:2dfbea61a4da4e6cb31959ac70260d258c2d3c939ee93d28ade607b09802a45e","observation_id":"4824165f-4a2a-4b82-bedc-ec848fa0da91","resolution":{"observed_at":"2026-08-15T18:20:45.344743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:45.848373Z","title":"Order matters: Agent-by-agent policy optimization","venue":null,"work_id":"0ff8457f-3c0d-49dc-84f5-ec26291426ba","year":2023},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.358732Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:51a363a57d7dbe380b4b9d3c6a5f5ba0dbe38524c1415750492a9fdb672280d4","observation_id":"ce931b36-4ec8-4cbe-8a96-ee0ae306df07","resolution":{"observed_at":"2026-08-15T18:20:45.853665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:45.829158Z","title":"Emergence of maps in the memories of blind navigation agents","venue":null,"work_id":"9140bebd-4c5e-4229-92c2-e474a4580d1e","year":2023},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.371678Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:21ed194a3fee903291ab1a991b5bfe6ac4070e53a30334e41486c3eefa8c03f9","observation_id":"04b3004c-d772-4bcc-a29e-1e54b140abac","resolution":{"observed_at":"2026-08-15T18:20:45.834884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:45.803965Z","title":"Learning latent representations to influence multi-agent interaction","venue":null,"work_id":"4d831b7e-8e4b-4cdf-8ce8-66653032992c","year":2021},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.377556Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:be2ff1a8427b73a08a87aceb7d870579e827e04469858daa360683a412addbca","observation_id":"be67f0dc-42f3-489e-86ca-122c136aa495","resolution":{"observed_at":"2026-08-15T18:20:45.812784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:45.387404Z","title":"The surprising effectiveness of ppo in cooperative multi-agent games","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.387404Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:28da80943d60d22b790176d666de2f537019eac6f643b6e0557af574c4daa3c8","observation_id":"95e00ed8-4c54-4fbc-bc6c-e5f12e2e37ea","resolution":{"observed_at":"2026-08-15T18:20:45.387404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:45.393733Z","title":"Heterogeneous-agent reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.393733Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:6332be2f75e2865c37cb6f6620ccbebe503a2d503f3e1d831d7ee97410d57400","observation_id":"8d1b8beb-e096-4cce-947e-48a0ebd00ea3","resolution":{"observed_at":"2026-08-15T18:20:45.393733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:45.750053Z","title":"Deep interactive bayesian reinforcement learning via meta-learning","venue":null,"work_id":"a5e57306-f6a9-4ae2-adfd-a4cf2e7617df","year":2021},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.408594Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:7f3afac6ff64cba3af3306538e485d25e260032aeef119dd923b51d61c37a02c","observation_id":"da94f39f-e44c-43f5-9bee-21cc1147454d","resolution":{"observed_at":"2026-08-15T18:20:45.757902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:20:45.426207Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T18:20:45.426207Z"},"links":{"citing_paper":"/paper/2507.18333"},"observation_digest":"sha256:a658e9a68f2616be69141a3e2a19d6076aa192ea998fa01ab5d9fa09944e0e94","observation_id":"13b01a95-80e2-4ca4-9965-6cdd89b796e4","resolution":{"observed_at":"2026-08-15T18:20:45.426207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.18333","last_updated":"2025-07-24T11:59:42Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T18:12:11.573930Z","submitted_at":"2025-07-24T11:59:42Z","title":"Remembering the Markov Property in Cooperative MARL"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":18},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2507.18333."}