{"as_of":"2026-08-12T04:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b4b1966a6695eaeed8da35c64be2c1c20d1eb925f3547541ce3b0bc700cdf210","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T00:10:22.389652Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.19873/citation-record","integrity":"/paper/2412.19873/integrity","json":"/paper/2412.19873/citation-record.json","paper":"/paper/2412.19873"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2208.10458","last_updated":"2022-10-12T14:25:27Z","snapshot_observed_at":"2026-07-06T13:44:18.807144Z","submitted_at":"2022-08-22T17:24:55Z","title":"Minimax-Optimal Multi-Agent RL in Markov Games With a Generative Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.10458","snapshot_observed_at":"2026-08-11T00:10:22.356655Z","title":"Minimax-opti mal multi-agent rl in markov games with a generative model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.19873","last_updated":"2024-12-27T16:37:33Z","snapshot_observed_at":"2026-08-10T23:53:11.923237Z","submitted_at":"2024-12-27T16:37:33Z","title":"Minimax-Optimal Multi-Agent Robust Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T00:10:22.356655Z"},"links":{"cited_paper":"/paper/2208.10458","citing_paper":"/paper/2412.19873"},"observation_digest":"sha256:11ee4f084eec8808250f30952c689293e822c3fbf33c9484e748f56fd11fc82f","observation_id":"915506fb-b58e-4222-b634-75fc90fcb3ae","resolution":{"observed_at":"2026-08-11T00:10:22.356655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:10:22.653781Z","title":"Markov games as a framework for multi-age nt reinforcement learning","venue":null,"work_id":"44ae49b4-0fdb-4c62-a60d-3b238c2ffc8a","year":1994},"citing_paper":{"arxiv_id":"2412.19873","last_updated":"2024-12-27T16:37:33Z","snapshot_observed_at":"2026-08-10T23:53:11.923237Z","submitted_at":"2024-12-27T16:37:33Z","title":"Minimax-Optimal Multi-Agent Robust Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T00:10:22.361057Z"},"links":{"citing_paper":"/paper/2412.19873"},"observation_digest":"sha256:ed49680741e8121bd8c691f9d9655f0e8ebf19a28b8a156a48e5cfb5f8f86cd9","observation_id":"0f938e5a-86e0-4651-8374-64b4a7743f45","resolution":{"observed_at":"2026-08-11T00:10:22.658431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.04184","last_updated":"2022-03-31T12:12:43Z","snapshot_observed_at":"2026-08-08T13:45:53.505063Z","submitted_at":"2021-10-08T15:06:22Z","title":"When Can We Learn General-Sum Markov Games with a Large Number of Players Sample-Efficiently?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.04184","snapshot_observed_at":"2026-08-11T00:10:22.369597Z","title":"When can we learn general-su m markov games with a large number of players sample-eﬃciently? arXiv preprint arXiv:2110.04184 ,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.19873","last_updated":"2024-12-27T16:37:33Z","snapshot_observed_at":"2026-08-10T23:53:11.923237Z","submitted_at":"2024-12-27T16:37:33Z","title":"Minimax-Optimal Multi-Agent Robust Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T00:10:22.369597Z"},"links":{"cited_paper":"/paper/2110.04184","citing_paper":"/paper/2412.19873"},"observation_digest":"sha256:c3189193dff684cbc4f86720e42d97ed0def1efa7da038e39d3ff3fd026a82a6","observation_id":"d2895eaa-edec-4d2a-8aaa-4105d8e89c17","resolution":{"observed_at":"2026-08-11T00:10:22.369597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01248","last_updated":"2023-09-12T16:20:15Z","snapshot_observed_at":"2026-08-06T03:46:42.421024Z","submitted_at":"2023-02-02T17:29:10Z","title":"Robust Markov Decision Processes without Model Estimation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01248","snapshot_observed_at":"2026-08-11T00:10:22.378171Z","title":"Robust markov decision processes without model estimation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.19873","last_updated":"2024-12-27T16:37:33Z","snapshot_observed_at":"2026-08-10T23:53:11.923237Z","submitted_at":"2024-12-27T16:37:33Z","title":"Minimax-Optimal Multi-Agent Robust Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T00:10:22.378171Z"},"links":{"cited_paper":"/paper/2302.01248","citing_paper":"/paper/2412.19873"},"observation_digest":"sha256:97b9de5349c5a3823bab3ec7fbc624ac5e9049a01e3ad04b136ed1888f9ef542","observation_id":"5fc7b9a9-a76c-4ba5-823f-38be90703761","resolution":{"observed_at":"2026-08-11T00:10:22.378171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.12430","last_updated":"2023-02-09T05:38:03Z","snapshot_observed_at":"2026-08-11T20:39:06.775397Z","submitted_at":"2022-09-26T05:35:44Z","title":"$O(T^{-1})$ Convergence of Optimistic-Follow-the-Regularized-Leader in Two-Player Zero-Sum Markov Games","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.12430","snapshot_observed_at":"2026-08-11T00:10:22.381901Z","title":"o(t−1) convergence of optimistic-follow-the-regularized-lead er in two-player zero-sum markov games","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.19873","last_updated":"2024-12-27T16:37:33Z","snapshot_observed_at":"2026-08-10T23:53:11.923237Z","submitted_at":"2024-12-27T16:37:33Z","title":"Minimax-Optimal Multi-Agent Robust Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T00:10:22.381901Z"},"links":{"cited_paper":"/paper/2209.12430","citing_paper":"/paper/2412.19873"},"observation_digest":"sha256:ac3e22747ee74676e799a396a5dca3186a5fae0847bd09e59ad02261fe9119f8","observation_id":"b3ce7b97-a151-420a-ba97-31cf6157b70f","resolution":{"observed_at":"2026-08-11T00:10:22.381901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.04724","last_updated":"2021-11-08T18:59:04Z","snapshot_observed_at":"2026-08-05T04:30:09.769285Z","submitted_at":"2021-11-08T18:59:04Z","title":"SustainBench: Benchmarks for Monitoring the Sustainable Development Goals with Machine Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.04724","snapshot_observed_at":"2026-08-11T00:10:22.386033Z","title":"Sustainbench: Ben chmarks for monitoring the sustainable development goals with machine learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.19873","last_updated":"2024-12-27T16:37:33Z","snapshot_observed_at":"2026-08-10T23:53:11.923237Z","submitted_at":"2024-12-27T16:37:33Z","title":"Minimax-Optimal Multi-Agent Robust Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T00:10:22.386033Z"},"links":{"cited_paper":"/paper/2111.04724","citing_paper":"/paper/2412.19873"},"observation_digest":"sha256:0205bf8c1ac310bef9e2cd372a21b81c1f623ff07a742bba411532e0c54fd949","observation_id":"f2a7760c-9654-4f32-9bd4-e2096752ddfa","resolution":{"observed_at":"2026-08-11T00:10:22.386033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.09776","last_updated":"2020-11-01T01:32:36Z","snapshot_observed_at":"2026-08-04T02:16:12.249684Z","submitted_at":"2020-10-19T18:26:10Z","title":"SMARTS: Scalable Multi-Agent Reinforcement Learning Training School for Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.09776","snapshot_observed_at":"2026-08-11T00:10:22.389652Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.19873","last_updated":"2024-12-27T16:37:33Z","snapshot_observed_at":"2026-08-10T23:53:11.923237Z","submitted_at":"2024-12-27T16:37:33Z","title":"Minimax-Optimal Multi-Agent Robust Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T00:10:22.389652Z"},"links":{"cited_paper":"/paper/2010.09776","citing_paper":"/paper/2412.19873"},"observation_digest":"sha256:355a3ccc5372a682012244cae0bb7800ef6c8b88fd1782f7eb7c139ae95d6cc2","observation_id":"6ebef0ff-5a5c-4bd3-8399-964dae04b62f","resolution":{"observed_at":"2026-08-11T00:10:22.389652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1002/j.1","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:10:22.630017Z","title":"URL https://onlinelibrary.wiley.com/doi/abs/10.1002/j.1538-7305.1952.tb01393.x","venue":null,"work_id":"d66824dd-c9a6-4739-9ef9-19e69493f06d","year":1952},"citing_paper":{"arxiv_id":"2412.19873","last_updated":"2024-12-27T16:37:33Z","snapshot_observed_at":"2026-08-10T23:53:11.923237Z","submitted_at":"2024-12-27T16:37:33Z","title":"Minimax-Optimal Multi-Agent Robust Reinforcement Learning","version":1},"reference_index":1952,"source":"pdf_text","source_observed_at":"2026-08-11T00:10:22.325880Z"},"links":{"citing_paper":"/paper/2412.19873"},"observation_digest":"sha256:28c013f686c7f0ea7d6de998e18323f785f23d960b90ecee6d5dc6d2f6fbd5b4","observation_id":"addabe88-3258-4706-b570-cb1396784e6a","resolution":{"observed_at":"2026-08-11T00:10:22.635176Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.20067","last_updated":"2025-01-31T10:02:45Z","snapshot_observed_at":"2026-08-09T05:08:18.457182Z","submitted_at":"2024-09-30T08:09:41Z","title":"Breaking the Curse of Multiagency in Robust Multi-Agent Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.20067","snapshot_observed_at":"2026-08-11T00:10:22.365457Z","title":"Breaking the curse of multiagency in robust multi-agent reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.19873","last_updated":"2024-12-27T16:37:33Z","snapshot_observed_at":"2026-08-10T23:53:11.923237Z","submitted_at":"2024-12-27T16:37:33Z","title":"Minimax-Optimal Multi-Agent Robust Reinforcement Learning","version":1},"reference_index":1953,"source":"pdf_text","source_observed_at":"2026-08-11T00:10:22.365457Z"},"links":{"cited_paper":"/paper/2409.20067","citing_paper":"/paper/2412.19873"},"observation_digest":"sha256:70cd18b9746834cbe4a835adf78ec705518ddff4d9590bcbc9d783bf0df7e67f","observation_id":"39163fcf-0cbe-496c-a08c-d6efa405b086","resolution":{"observed_at":"2026-08-11T00:10:22.365457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.09453","last_updated":"2020-09-26T11:49:05Z","snapshot_observed_at":"2026-08-08T18:52:56.345158Z","submitted_at":"2019-08-26T03:31:35Z","title":"OpenSpiel: A Framework for Reinforcement Learning in Games","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.09453","snapshot_observed_at":"2026-08-11T00:10:22.352248Z","title":"Openspiel: A framework for reinforcement learning in games","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2412.19873","last_updated":"2024-12-27T16:37:33Z","snapshot_observed_at":"2026-08-10T23:53:11.923237Z","submitted_at":"2024-12-27T16:37:33Z","title":"Minimax-Optimal Multi-Agent Robust Reinforcement Learning","version":1},"reference_index":1998,"source":"pdf_text","source_observed_at":"2026-08-11T00:10:22.352248Z"},"links":{"cited_paper":"/paper/1908.09453","citing_paper":"/paper/2412.19873"},"observation_digest":"sha256:5f50dab388e93cc73af4c246e898613ca1bbe6ed60cba266f026084f43612bb7","observation_id":"02150360-0090-4cf1-981c-c15e25cc39c5","resolution":{"observed_at":"2026-08-11T00:10:22.352248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.00423","last_updated":"2019-06-02T15:24:19Z","snapshot_observed_at":"2026-07-06T07:57:18.438339Z","submitted_at":"2019-06-02T15:24:19Z","title":"Feature-Based Q-Learning for Two-Player Stochastic Games","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.00423","snapshot_observed_at":"2026-08-11T00:10:22.338397Z","title":"Feature-based q-learn ing for two-player stochastic games","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2412.19873","last_updated":"2024-12-27T16:37:33Z","snapshot_observed_at":"2026-08-10T23:53:11.923237Z","submitted_at":"2024-12-27T16:37:33Z","title":"Minimax-Optimal Multi-Agent Robust Reinforcement Learning","version":1},"reference_index":2005,"source":"pdf_text","source_observed_at":"2026-08-11T00:10:22.338397Z"},"links":{"cited_paper":"/paper/1906.00423","citing_paper":"/paper/2412.19873"},"observation_digest":"sha256:bdb610a5a7c1d9506fba514e036be306c72ebe0c0bb447d4d0ed6796c7d43af5","observation_id":"4ea42e5f-01e7-4d3b-8e87-e50599d88246","resolution":{"observed_at":"2026-08-11T00:10:22.338397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04044","last_updated":"2024-02-26T15:18:31Z","snapshot_observed_at":"2026-08-04T18:55:04.998004Z","submitted_at":"2022-06-08T17:58:06Z","title":"Model-Based Reinforcement Learning for Offline Zero-Sum Markov Games","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04044","snapshot_observed_at":"2026-08-11T00:10:22.373621Z","title":"Model-base d reinforcement learning is minimax-optimal for oﬄine zero-sum markov games","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.19873","last_updated":"2024-12-27T16:37:33Z","snapshot_observed_at":"2026-08-10T23:53:11.923237Z","submitted_at":"2024-12-27T16:37:33Z","title":"Minimax-Optimal Multi-Agent Robust Reinforcement Learning","version":1},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-11T00:10:22.373621Z"},"links":{"cited_paper":"/paper/2206.04044","citing_paper":"/paper/2412.19873"},"observation_digest":"sha256:c4e074ff6f9a389ee4f4774d506ee2b409b7b05508615893a79e47ddd35d5c7b","observation_id":"ddeba19e-c782-45bc-ad07-ea24804a82ec","resolution":{"observed_at":"2026-08-11T00:10:22.373621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14555","last_updated":"2021-10-27T16:25:55Z","snapshot_observed_at":"2026-08-09T10:31:53.237354Z","submitted_at":"2021-10-27T16:25:55Z","title":"V-Learning -- A Simple, Efficient, Decentralized Algorithm for Multiagent RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14555","snapshot_observed_at":"2026-08-11T00:10:22.343287Z","title":"V-lear ning–a simple, eﬃcient, decentralized algorithm for multiagent rl","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.19873","last_updated":"2024-12-27T16:37:33Z","snapshot_observed_at":"2026-08-10T23:53:11.923237Z","submitted_at":"2024-12-27T16:37:33Z","title":"Minimax-Optimal Multi-Agent Robust Reinforcement Learning","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-11T00:10:22.343287Z"},"links":{"cited_paper":"/paper/2110.14555","citing_paper":"/paper/2412.19873"},"observation_digest":"sha256:c6344ce24f5bf52ec35386bc3ca5bbbb4785304af95f29328453f65722c6403b","observation_id":"68fb79ea-9549-4541-8865-d5c546ea554d","resolution":{"observed_at":"2026-08-11T00:10:22.343287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.01562","last_updated":"2019-11-05T01:40:42Z","snapshot_observed_at":"2026-08-09T20:10:56.490519Z","submitted_at":"2019-11-05T01:40:42Z","title":"DeepRacer: Educational Autonomous Racing Platform for Experimentation with Sim2Real Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.01562","snapshot_observed_at":"2026-08-11T00:10:22.321172Z","title":"Deepracer: Educa tional autonomous racing platform for experimentation with sim2real reinforcement learning","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2412.19873","last_updated":"2024-12-27T16:37:33Z","snapshot_observed_at":"2026-08-10T23:53:11.923237Z","submitted_at":"2024-12-27T16:37:33Z","title":"Minimax-Optimal Multi-Agent Robust Reinforcement Learning","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-11T00:10:22.321172Z"},"links":{"cited_paper":"/paper/1911.01562","citing_paper":"/paper/2412.19873"},"observation_digest":"sha256:d94fa06a74e0fa02e370e95ac9f7a9fb948104b92a64289a9fec1571766231a8","observation_id":"3cbd4675-0fb1-45e1-942f-2c23bf85c093","resolution":{"observed_at":"2026-08-11T00:10:22.321172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10062","last_updated":"2024-03-23T03:50:18Z","snapshot_observed_at":"2026-08-10T11:13:37.661142Z","submitted_at":"2023-09-18T18:17:56Z","title":"SMART-LLM: Smart Multi-Agent Robot Task Planning using Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10062","snapshot_observed_at":"2026-08-11T00:10:22.347791Z","title":"Smart-llm: Smart multi-agent robot task planning using large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.19873","last_updated":"2024-12-27T16:37:33Z","snapshot_observed_at":"2026-08-10T23:53:11.923237Z","submitted_at":"2024-12-27T16:37:33Z","title":"Minimax-Optimal Multi-Agent Robust Reinforcement Learning","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-11T00:10:22.347791Z"},"links":{"cited_paper":"/paper/2309.10062","citing_paper":"/paper/2412.19873"},"observation_digest":"sha256:a03e90ae3867a807165226890d70f0e79dd3fd5b553d2d0ab0c7c5be8f936dff","observation_id":"573bbe92-7adc-4381-a30f-f0deaafe9f67","resolution":{"observed_at":"2026-08-11T00:10:22.347791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:10:22.665918Z","title":"Fast bell man updates for robust mdps","venue":null,"work_id":"ee253493-6382-401e-b10d-499ba3aabc55","year":1979},"citing_paper":{"arxiv_id":"2412.19873","last_updated":"2024-12-27T16:37:33Z","snapshot_observed_at":"2026-08-10T23:53:11.923237Z","submitted_at":"2024-12-27T16:37:33Z","title":"Minimax-Optimal Multi-Agent Robust Reinforcement Learning","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-11T00:10:22.333835Z"},"links":{"citing_paper":"/paper/2412.19873"},"observation_digest":"sha256:76d22075e51f76b8ea583a163b1c39620a8d87f796742e5ad79139a0051e34c7","observation_id":"72b44bf1-66ce-4e3c-8873-a7c3b9a4e011","resolution":{"observed_at":"2026-08-11T00:10:22.669527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.02705","last_updated":"2024-04-12T17:58:52Z","snapshot_observed_at":"2026-08-08T23:34:50.011359Z","submitted_at":"2022-12-06T01:57:33Z","title":"What is the Solution for State-Adversarial Multi-Agent Reinforcement Learning?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.02705","snapshot_observed_at":"2026-08-11T00:10:22.329513Z","title":"What is the solution for state-adversarial multi-agent reinforcemen t learning? arXiv preprint arXiv:2212.02705 ,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.19873","last_updated":"2024-12-27T16:37:33Z","snapshot_observed_at":"2026-08-10T23:53:11.923237Z","submitted_at":"2024-12-27T16:37:33Z","title":"Minimax-Optimal Multi-Agent Robust Reinforcement Learning","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T00:10:22.329513Z"},"links":{"cited_paper":"/paper/2212.02705","citing_paper":"/paper/2412.19873"},"observation_digest":"sha256:6342217cc5f293c71a86758f537abfa324d1df210d8ad0e1d6f24001688aeb41","observation_id":"352ad0fb-5974-488d-9a31-d218b7db4354","resolution":{"observed_at":"2026-08-11T00:10:22.329513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.19873","last_updated":"2024-12-27T16:37:33Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T23:53:11.923237Z","submitted_at":"2024-12-27T16:37:33Z","title":"Minimax-Optimal Multi-Agent Robust Reinforcement Learning"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 0 inbound Pith citation observations for arXiv:2412.19873."}