{"as_of":"2026-08-10T16:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1888c45b89d3f78506559a993a0692e568ee8096a34f048a677ba9ea22505eac","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T19:19:43.882854Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":9,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.10256","last_updated":"2024-07-03T00:27:14Z","snapshot_observed_at":"2026-08-07T17:55:34.308231Z","submitted_at":"2023-12-15T23:16:54Z","title":"Multi-agent Reinforcement Learning: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10256","snapshot_observed_at":"2026-08-08T19:19:43.882854Z","title":"Advances in Neural Infor- mation Processing Systems, 35: 18343–18362","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.05453","last_updated":"2025-02-08T05:26:02Z","snapshot_observed_at":"2026-08-08T19:13:22.338944Z","submitted_at":"2025-02-08T05:26:02Z","title":"LLM-Powered Decentralized Generative Agents with Adaptive Hierarchical Knowledge Graph for Cooperative Planning","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-08T19:19:43.882854Z"},"links":{"cited_paper":"/paper/2312.10256","citing_paper":"/paper/2502.05453"},"observation_digest":"sha256:3516733dc90c03bda39ea9520e66d88a9ba8b89375d4cb2c0b603600f68544c8","observation_id":"267555ed-9429-4640-b87a-43048ef1a28d","resolution":{"observed_at":"2026-08-08T19:19:43.882854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10256","last_updated":"2024-07-03T00:27:14Z","snapshot_observed_at":"2026-08-07T17:55:34.308231Z","submitted_at":"2023-12-15T23:16:54Z","title":"Multi-agent Reinforcement Learning: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10256","snapshot_observed_at":"2026-08-08T17:54:46.513662Z","title":"Multi-agent reinforcement learning: A comprehensive survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05812","last_updated":"2025-02-09T08:35:09Z","snapshot_observed_at":"2026-08-09T02:13:04.543066Z","submitted_at":"2025-02-09T08:35:09Z","title":"Multi-Agent Reinforcement Learning in Wireless Distributed Networks for 6G","version":1},"reference_index":145,"source":"pdf_text","source_observed_at":"2026-08-08T17:54:46.513662Z"},"links":{"cited_paper":"/paper/2312.10256","citing_paper":"/paper/2502.05812"},"observation_digest":"sha256:5548a8af1287bd3f26ff8b4b3610d8e4b1e48e109b241fad87dd1b10007c12ff","observation_id":"ec0765bb-437e-40c6-8037-1679f70e33d7","resolution":{"observed_at":"2026-08-08T17:54:46.513662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10256","last_updated":"2024-07-03T00:27:14Z","snapshot_observed_at":"2026-08-07T17:55:34.308231Z","submitted_at":"2023-12-15T23:16:54Z","title":"Multi-agent Reinforcement Learning: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10256","snapshot_observed_at":"2026-08-07T14:10:40.061190Z","title":"Multi-agent reinforcement learning: A comprehensive survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19837","last_updated":"2025-05-26T11:19:43Z","snapshot_observed_at":"2026-08-08T18:53:17.848101Z","submitted_at":"2025-05-26T11:19:43Z","title":"Multi-Agent Reinforcement Learning in Cybersecurity: From Fundamentals to Applications","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:10:40.061190Z"},"links":{"cited_paper":"/paper/2312.10256","citing_paper":"/paper/2505.19837"},"observation_digest":"sha256:737b62c9c83ad0b9e143c9b76e90807f4d78eafbb164b704d8d6c7dbf6a8441e","observation_id":"af5d2004-caaf-47b6-ac61-7b0028f94f0a","resolution":{"observed_at":"2026-08-07T14:10:40.061190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10256","last_updated":"2024-07-03T00:27:14Z","snapshot_observed_at":"2026-08-07T17:55:34.308231Z","submitted_at":"2023-12-15T23:16:54Z","title":"Multi-agent Reinforcement Learning: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10256","snapshot_observed_at":"2026-08-06T23:59:47.982531Z","title":"Multi-agent reinforcement learning: A comprehensive survey","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.15451","last_updated":"2025-06-18T13:24:04Z","snapshot_observed_at":"2026-08-09T02:12:51.970287Z","submitted_at":"2025-06-18T13:24:04Z","title":"AgentGroupChat-V2: Divide-and-Conquer Is What LLM-Based Multi-Agent System Need","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:59:47.982531Z"},"links":{"cited_paper":"/paper/2312.10256","citing_paper":"/paper/2506.15451"},"observation_digest":"sha256:538159ec98e0def2c494818c72a54bb8730cf82ec754ffff10c804570588ad82","observation_id":"876472e3-9c87-4479-b2e4-b8f56a2be4f3","resolution":{"observed_at":"2026-08-06T23:59:47.982531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10256","last_updated":"2024-07-03T00:27:14Z","snapshot_observed_at":"2026-08-07T17:55:34.308231Z","submitted_at":"2023-12-15T23:16:54Z","title":"Multi-agent Reinforcement Learning: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10256","snapshot_observed_at":"2026-08-06T10:40:38.764919Z","title":"Multi-agent reinforcement learning: A comprehensive survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23604","last_updated":"2026-06-30T11:26:47Z","snapshot_observed_at":"2026-08-07T03:53:17.805976Z","submitted_at":"2025-07-31T14:42:12Z","title":"Hierarchical Message-Passing Policies for Multi-Agent Reinforcement Learning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T10:40:38.764919Z"},"links":{"cited_paper":"/paper/2312.10256","citing_paper":"/paper/2507.23604"},"observation_digest":"sha256:966603407fcabbb6668e75fd78b82c1613041924b8bdec9a35affaf9a7cec046","observation_id":"862c2bdf-51a2-4d24-b699-85185337629b","resolution":{"observed_at":"2026-08-06T10:40:38.764919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10256","last_updated":"2024-07-03T00:27:14Z","snapshot_observed_at":"2026-08-07T17:55:34.308231Z","submitted_at":"2023-12-15T23:16:54Z","title":"Multi-agent Reinforcement Learning: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":"2312.10256","doi":"10.48550/arxiv.2312.10256","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.10256","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-agent reinforcement learning: A comprehensive survey","venue":"arXiv (Cornell University)","work_id":"e1130275-34a2-4ccd-a589-7f945d00c81c","year":2023},"citing_paper":{"arxiv_id":"2509.02547","last_updated":"2026-04-17T18:09:08Z","snapshot_observed_at":"2026-08-03T09:07:42.489237Z","submitted_at":"2025-09-02T17:46:26Z","title":"The Landscape of Agentic Reinforcement Learning for LLMs: A Survey","version":5},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-18T19:19:36.427337Z"},"links":{"cited_paper":"/paper/2312.10256","citing_paper":"/paper/2509.02547"},"observation_digest":"sha256:49b60a70909c35e309d0aae816dbe84ad44b255fe6120f429e7a86f4a75f793b","observation_id":"7a445999-f65f-4c74-8227-913d327376e2","resolution":{"observed_at":"2026-05-18T19:21:48.282484Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10256","last_updated":"2024-07-03T00:27:14Z","snapshot_observed_at":"2026-08-07T17:55:34.308231Z","submitted_at":"2023-12-15T23:16:54Z","title":"Multi-agent Reinforcement Learning: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":"2312.10256","doi":"10.48550/arxiv.2312.10256","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.10256","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-agent reinforcement learning: A comprehensive survey","venue":"arXiv (Cornell University)","work_id":"e1130275-34a2-4ccd-a589-7f945d00c81c","year":2023},"citing_paper":{"arxiv_id":"2509.08827","last_updated":"2025-10-09T17:08:52Z","snapshot_observed_at":"2026-08-06T15:38:05.011922Z","submitted_at":"2025-09-10T17:59:43Z","title":"A Survey of Reinforcement Learning for Large Reasoning Models","version":3},"reference_index":218,"source":"arxiv_source","source_observed_at":"2026-05-18T00:02:24.352947Z"},"links":{"cited_paper":"/paper/2312.10256","citing_paper":"/paper/2509.08827"},"observation_digest":"sha256:2198896c89214abde683ca2a6aa72921dfc47fe91b36398e4fe61718548f7271","observation_id":"72b51e1f-523b-4a3e-bccf-bcabd1e154c8","resolution":{"observed_at":"2026-05-18T00:05:31.635283Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10256","last_updated":"2024-07-03T00:27:14Z","snapshot_observed_at":"2026-08-07T17:55:34.308231Z","submitted_at":"2023-12-15T23:16:54Z","title":"Multi-agent Reinforcement Learning: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10256","snapshot_observed_at":"2026-07-13T21:18:07.586683Z","title":"Multi-agent reinforcement learning: A comprehensive survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.20750","last_updated":"2026-06-23T07:54:44Z","snapshot_observed_at":"2026-08-07T13:46:00.157938Z","submitted_at":"2026-03-21T10:47:09Z","title":"Subjective-Graph LLM Agents for Simulating Uncertainty in Classroom Social Perception","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-13T21:18:07.586683Z"},"links":{"cited_paper":"/paper/2312.10256","citing_paper":"/paper/2603.20750"},"observation_digest":"sha256:d30496e42e73ab718b115b77f6b142f0f46673a62681fcc6b571a73e84c28a2d","observation_id":"f96b8d00-0f75-4660-8149-f5f2cafa157f","resolution":{"observed_at":"2026-07-13T21:18:07.586683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10256","last_updated":"2024-07-03T00:27:14Z","snapshot_observed_at":"2026-08-07T17:55:34.308231Z","submitted_at":"2023-12-15T23:16:54Z","title":"Multi-agent Reinforcement Learning: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":"2312.10256","doi":"10.48550/arxiv.2312.10256","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.10256","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-agent reinforcement learning: A comprehensive survey","venue":"arXiv (Cornell University)","work_id":"e1130275-34a2-4ccd-a589-7f945d00c81c","year":2023},"citing_paper":{"arxiv_id":"2604.08805","last_updated":"2026-04-09T22:41:01Z","snapshot_observed_at":"2026-07-06T22:57:50.266735Z","submitted_at":"2026-04-09T22:41:01Z","title":"Building Better Environments for Autonomous Cyber Defence","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T16:46:41.137112Z"},"links":{"cited_paper":"/paper/2312.10256","citing_paper":"/paper/2604.08805"},"observation_digest":"sha256:0e52c7ef18756f40e313a1d9d55162859ff97d61f7aeae75a7715c6e0ec8332c","observation_id":"23ecf2ec-e549-4d79-9992-291af1b23257","resolution":{"observed_at":"2026-05-11T08:11:03.788009Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10256","last_updated":"2024-07-03T00:27:14Z","snapshot_observed_at":"2026-08-07T17:55:34.308231Z","submitted_at":"2023-12-15T23:16:54Z","title":"Multi-agent Reinforcement Learning: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":"2312.10256","doi":"10.48550/arxiv.2312.10256","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.10256","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-agent reinforcement learning: A comprehensive survey","venue":"arXiv (Cornell University)","work_id":"e1130275-34a2-4ccd-a589-7f945d00c81c","year":2023},"citing_paper":{"arxiv_id":"2604.18133","last_updated":"2026-04-20T12:00:31Z","snapshot_observed_at":"2026-08-03T09:21:05.928583Z","submitted_at":"2026-04-20T12:00:31Z","title":"Multi-Agent Systems: From Classical Paradigms to Large Foundation Model-Enabled Futures","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T04:31:28.242097Z"},"links":{"cited_paper":"/paper/2312.10256","citing_paper":"/paper/2604.18133"},"observation_digest":"sha256:b9689fcadb36c5a9f359bde26a402c76c072930d427b0cbd382aff12fd4343d5","observation_id":"3ffb94aa-6d67-45db-93d7-739f5032977d","resolution":{"observed_at":"2026-05-11T11:51:04.089215Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10256","last_updated":"2024-07-03T00:27:14Z","snapshot_observed_at":"2026-08-07T17:55:34.308231Z","submitted_at":"2023-12-15T23:16:54Z","title":"Multi-agent Reinforcement Learning: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":"2312.10256","doi":"10.48550/arxiv.2312.10256","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.10256","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-agent reinforcement learning: A comprehensive survey","venue":"arXiv (Cornell University)","work_id":"e1130275-34a2-4ccd-a589-7f945d00c81c","year":2023},"citing_paper":{"arxiv_id":"2605.01805","last_updated":"2026-05-10T14:23:04Z","snapshot_observed_at":"2026-07-06T23:14:57.459903Z","submitted_at":"2026-05-03T10:05:48Z","title":"MAGIC: Multi-Step Advantage-Gated Causal Influence for Multi-agent Reinforcement Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-09T16:26:36.341659Z"},"links":{"cited_paper":"/paper/2312.10256","citing_paper":"/paper/2605.01805"},"observation_digest":"sha256:52c2c7be60ee66bcf45e80baca1b11aee7b1120d6aacb9ce8485c0715de6b744","observation_id":"acf5e0b6-ec12-4f3f-a450-410f2e91bf35","resolution":{"observed_at":"2026-05-11T16:31:09.293003Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10256","last_updated":"2024-07-03T00:27:14Z","snapshot_observed_at":"2026-08-07T17:55:34.308231Z","submitted_at":"2023-12-15T23:16:54Z","title":"Multi-agent Reinforcement Learning: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":"2312.10256","doi":"10.48550/arxiv.2312.10256","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.10256","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-agent reinforcement learning: A comprehensive survey","venue":"arXiv (Cornell University)","work_id":"e1130275-34a2-4ccd-a589-7f945d00c81c","year":2023},"citing_paper":{"arxiv_id":"2605.28699","last_updated":"2026-05-27T16:25:21Z","snapshot_observed_at":"2026-08-09T22:47:57.867422Z","submitted_at":"2026-05-27T16:25:21Z","title":"TRACER: Turn-level Regret Matching with Inner Reinforcement Credit for Cooperative Multi-LLM Reasoning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-29T12:20:16.121824Z"},"links":{"cited_paper":"/paper/2312.10256","citing_paper":"/paper/2605.28699"},"observation_digest":"sha256:96511fa3c9d7dd00cc87b93db755f481e3a21d235c46d11d393e82a11e1e6d6d","observation_id":"0cf26807-cba0-4c17-b1b4-e8efe1a9572c","resolution":{"observed_at":"2026-06-29T12:23:23.810958Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10256","last_updated":"2024-07-03T00:27:14Z","snapshot_observed_at":"2026-08-07T17:55:34.308231Z","submitted_at":"2023-12-15T23:16:54Z","title":"Multi-agent Reinforcement Learning: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":"2312.10256","doi":"10.48550/arxiv.2312.10256","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.10256","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-agent reinforcement learning: A comprehensive survey","venue":"arXiv (Cornell University)","work_id":"e1130275-34a2-4ccd-a589-7f945d00c81c","year":2023},"citing_paper":{"arxiv_id":"2606.01249","last_updated":"2026-06-17T04:44:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-31T14:04:51Z","title":"Trust Region On-Policy Distillation","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-28T17:38:50.313305Z"},"links":{"cited_paper":"/paper/2312.10256","citing_paper":"/paper/2606.01249"},"observation_digest":"sha256:f6ead09424d4a46175e318ba5abce73d487bd02de0df4a4a0342730c3c061dca","observation_id":"c2546e38-9ed0-47bc-92c9-3cc7c68b2b97","resolution":{"observed_at":"2026-07-01T20:56:13.360634Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10256","last_updated":"2024-07-03T00:27:14Z","snapshot_observed_at":"2026-08-07T17:55:34.308231Z","submitted_at":"2023-12-15T23:16:54Z","title":"Multi-agent Reinforcement Learning: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":"2312.10256","doi":"10.48550/arxiv.2312.10256","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.10256","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-agent reinforcement learning: A comprehensive survey","venue":"arXiv (Cornell University)","work_id":"e1130275-34a2-4ccd-a589-7f945d00c81c","year":2023},"citing_paper":{"arxiv_id":"2606.21943","last_updated":"2026-06-20T08:20:41Z","snapshot_observed_at":"2026-07-06T23:56:54.959593Z","submitted_at":"2026-06-20T08:20:41Z","title":"Modularized Reinforcement Learning on LLMs: From MDP Creation to Exploration and Learning","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-06-26T12:15:08.304150Z"},"links":{"cited_paper":"/paper/2312.10256","citing_paper":"/paper/2606.21943"},"observation_digest":"sha256:2f35fe032ee3f4d12e9fa46cf1a5f4d28dc6bcfc7678129505e090959f32387e","observation_id":"2fb30b31-c1dd-4828-89ec-d2cfaff0698f","resolution":{"observed_at":"2026-07-04T08:09:40.724416Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10256","last_updated":"2024-07-03T00:27:14Z","snapshot_observed_at":"2026-08-07T17:55:34.308231Z","submitted_at":"2023-12-15T23:16:54Z","title":"Multi-agent Reinforcement Learning: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":"2312.10256","doi":"10.48550/arxiv.2312.10256","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.10256","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-agent reinforcement learning: A comprehensive survey","venue":"arXiv (Cornell University)","work_id":"e1130275-34a2-4ccd-a589-7f945d00c81c","year":2023},"citing_paper":{"arxiv_id":"2606.23153","last_updated":"2026-06-22T10:58:43Z","snapshot_observed_at":"2026-08-03T15:32:19.216975Z","submitted_at":"2026-06-22T10:58:43Z","title":"Asymmetric physics enables efficient learning in quadrupedal robot swarms","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-26T08:31:18.036335Z"},"links":{"cited_paper":"/paper/2312.10256","citing_paper":"/paper/2606.23153"},"observation_digest":"sha256:e0bb70e1f16937ba6b78fc9a76089a1cacc1b1179c0d7d7bd2815694e23fd8fd","observation_id":"255c085f-74ad-4dd3-ab3a-4445d8a1d335","resolution":{"observed_at":"2026-07-04T10:49:45.775933Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10256","last_updated":"2024-07-03T00:27:14Z","snapshot_observed_at":"2026-08-07T17:55:34.308231Z","submitted_at":"2023-12-15T23:16:54Z","title":"Multi-agent Reinforcement Learning: A Comprehensive Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10256","snapshot_observed_at":"2026-08-01T09:47:57.722607Z","title":"Multi-agent Reinforcement Learning: A Comprehensive Survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27310","last_updated":"2026-07-29T17:53:52Z","snapshot_observed_at":"2026-08-07T01:56:49.630640Z","submitted_at":"2026-07-29T17:53:52Z","title":"TrustChain-Review: A Risk-Adaptive Blockchain and Game-Theoretic Framework for Trustworthy AI-Assisted Code Review","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T09:47:57.722607Z"},"links":{"cited_paper":"/paper/2312.10256","citing_paper":"/paper/2607.27310"},"observation_digest":"sha256:1c1b62dfaa9889f78336273d61a784e5be17103f571059839e9f71b8ab920eb2","observation_id":"e7f564a2-9086-455b-9a5c-5ff10f6b4663","resolution":{"observed_at":"2026-08-01T09:47:57.722607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2312.10256/citation-record","integrity":"/paper/2312.10256/integrity","json":"/paper/2312.10256/citation-record.json","paper":"/paper/2312.10256"},"outbound":[],"paper":{"arxiv_id":"2312.10256","last_updated":"2024-07-03T00:27:14Z","latest_version":2,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-07T17:55:34.308231Z","submitted_at":"2023-12-15T23:16:54Z","title":"Multi-agent Reinforcement Learning: A Comprehensive Survey"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 16 inbound Pith citation observations for arXiv:2312.10256."}