{"as_of":"2026-07-31T13:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e23a7bc5cec20d97a5131be06f8c2f8c79e54d7bc666f0f64b2814dbcc322138","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-07-31T06:34:12.847434+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T07:38:02.368884Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-10T06:15:00.866473Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2006.07869","last_updated":"2021-11-09T10:42:04Z","snapshot_observed_at":"2026-07-06T09:28:53.031338Z","submitted_at":"2020-06-14T11:22:53Z","title":"Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks","version":4},"cited_work":{"arxiv_id":"2006.07869","doi":"10.48550/arxiv.2006.07869","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.07869","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Benchmarking multi-agent deep reinforcement learn- ing algorithms in cooperative tasks","venue":null,"work_id":"ffcc70b2-bfb7-4e18-a3a9-c4614c3bc974","year":2006},"citing_paper":{"arxiv_id":"2502.03506","last_updated":"2026-05-04T09:30:33Z","snapshot_observed_at":"2026-07-06T20:31:50.759186Z","submitted_at":"2025-02-05T12:06:54Z","title":"Optimistic {\\epsilon}-Greedy Exploration for Cooperative Multi-Agent Reinforcement Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-23T04:16:54.807723Z"},"links":{"cited_paper":"/paper/2006.07869","citing_paper":"/paper/2502.03506"},"observation_digest":"sha256:953fecaed9848bd89400873b668dbb638a42bfa7764114e9a7883264bcee8e18","observation_id":"d1922028-8854-4da9-97d6-ebce5426a694","resolution":{"observed_at":"2026-05-23T04:17:30.907248Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07869","last_updated":"2021-11-09T10:42:04Z","snapshot_observed_at":"2026-07-06T09:28:53.031338Z","submitted_at":"2020-06-14T11:22:53Z","title":"Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks","version":4},"cited_work":{"arxiv_id":"2006.07869","doi":"10.48550/arxiv.2006.07869","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.07869","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Benchmarking multi-agent deep reinforcement learn- ing algorithms in cooperative tasks","venue":null,"work_id":"ffcc70b2-bfb7-4e18-a3a9-c4614c3bc974","year":2006},"citing_paper":{"arxiv_id":"2508.01049","last_updated":"2026-05-13T06:44:44Z","snapshot_observed_at":"2026-07-06T22:06:34.382572Z","submitted_at":"2025-08-01T20:07:25Z","title":"Centralized Adaptive Sampling for Reliable Co-Training of Independent Multi-Agent Policies","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-19T01:05:17.086399Z"},"links":{"cited_paper":"/paper/2006.07869","citing_paper":"/paper/2508.01049"},"observation_digest":"sha256:0c982e1eb50be4710324bfdd33173855c54f788b3aa14428872c6dd1376e06ab","observation_id":"9a029f53-bc49-464a-8c19-859f210dd09d","resolution":{"observed_at":"2026-05-19T01:06:57.465247Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07869","last_updated":"2021-11-09T10:42:04Z","snapshot_observed_at":"2026-07-06T09:28:53.031338Z","submitted_at":"2020-06-14T11:22:53Z","title":"Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks","version":4},"cited_work":{"arxiv_id":"2006.07869","doi":"10.48550/arxiv.2006.07869","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.07869","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Benchmarking multi-agent deep reinforcement learn- ing algorithms in cooperative tasks","venue":null,"work_id":"ffcc70b2-bfb7-4e18-a3a9-c4614c3bc974","year":2006},"citing_paper":{"arxiv_id":"2511.14135","last_updated":"2026-04-22T21:56:51Z","snapshot_observed_at":"2026-07-06T22:36:08.495952Z","submitted_at":"2025-11-18T04:48:50Z","title":"AdaFair-MARL: Enforcing Adaptive Fairness Constraints in Multi-Agent Reinforcement Learning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-17T20:18:09.847453Z"},"links":{"cited_paper":"/paper/2006.07869","citing_paper":"/paper/2511.14135"},"observation_digest":"sha256:bf2be8d2b2d2e8599b062993397b014445c5c5d0bf6ce25c3caeaede89b5bc42","observation_id":"e196b80d-e2f4-4a5a-a4ad-8a288b05d8f0","resolution":{"observed_at":"2026-05-17T20:20:11.904137Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07869","last_updated":"2021-11-09T10:42:04Z","snapshot_observed_at":"2026-07-06T09:28:53.031338Z","submitted_at":"2020-06-14T11:22:53Z","title":"Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks","version":4},"cited_work":{"arxiv_id":"2006.07869","doi":"10.48550/arxiv.2006.07869","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.07869","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Benchmarking multi-agent deep reinforcement learn- ing algorithms in cooperative tasks","venue":null,"work_id":"ffcc70b2-bfb7-4e18-a3a9-c4614c3bc974","year":2006},"citing_paper":{"arxiv_id":"2511.20857","last_updated":"2026-05-18T16:18:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-25T21:08:07Z","title":"Evo-Memory: Benchmarking LLM Agent Test-time Learning with Self-Evolving Memory","version":1},"reference_index":103,"source":"arxiv_source","source_observed_at":"2026-05-14T23:13:15.016486Z"},"links":{"cited_paper":"/paper/2006.07869","citing_paper":"/paper/2511.20857"},"observation_digest":"sha256:1dfc633ae023b5f37e8e8f6355e8b9f8df239f38a50f781349938f73659db4bf","observation_id":"79035392-af4c-4926-ab07-8d772f861638","resolution":{"observed_at":"2026-05-14T23:13:15.663980Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07869","last_updated":"2021-11-09T10:42:04Z","snapshot_observed_at":"2026-07-06T09:28:53.031338Z","submitted_at":"2020-06-14T11:22:53Z","title":"Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks","version":4},"cited_work":{"arxiv_id":"2006.07869","doi":"10.48550/arxiv.2006.07869","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.07869","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Benchmarking multi-agent deep reinforcement learn- ing algorithms in cooperative tasks","venue":null,"work_id":"ffcc70b2-bfb7-4e18-a3a9-c4614c3bc974","year":2006},"citing_paper":{"arxiv_id":"2603.23964","last_updated":"2026-04-13T08:15:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-03-25T05:56:54Z","title":"From Pixels to Digital Agents: An Empirical Study on the Taxonomy and Technological Trends of Reinforcement Learning Environments","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-15T01:20:03.181903Z"},"links":{"cited_paper":"/paper/2006.07869","citing_paper":"/paper/2603.23964"},"observation_digest":"sha256:26fa8715cfebb9d74ab1515f3ee63498d5399a1bf8d22e7965b6588b592b5d58","observation_id":"c61a811d-1cb9-4766-8d51-a4b0b2a2f09d","resolution":{"observed_at":"2026-05-15T01:23:27.178151Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07869","last_updated":"2021-11-09T10:42:04Z","snapshot_observed_at":"2026-07-06T09:28:53.031338Z","submitted_at":"2020-06-14T11:22:53Z","title":"Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks","version":4},"cited_work":{"arxiv_id":"2006.07869","doi":"10.48550/arxiv.2006.07869","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.07869","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Benchmarking multi-agent deep reinforcement learn- ing algorithms in cooperative tasks","venue":null,"work_id":"ffcc70b2-bfb7-4e18-a3a9-c4614c3bc974","year":2006},"citing_paper":{"arxiv_id":"2604.18190","last_updated":"2026-04-20T12:45:59Z","snapshot_observed_at":"2026-07-06T23:05:08.728446Z","submitted_at":"2026-04-20T12:45:59Z","title":"Scalable Neighborhood-Based Multi-Agent Actor-Critic","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T05:19:42.391924Z"},"links":{"cited_paper":"/paper/2006.07869","citing_paper":"/paper/2604.18190"},"observation_digest":"sha256:c726c1c8ef1acb8f1439cb6fb284c26af5babc6d241921b3fc57002797cf912b","observation_id":"61dcb148-354e-44ae-95e4-2426dad23a5f","resolution":{"observed_at":"2026-05-10T09:23:38.040503Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07869","last_updated":"2021-11-09T10:42:04Z","snapshot_observed_at":"2026-07-06T09:28:53.031338Z","submitted_at":"2020-06-14T11:22:53Z","title":"Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks","version":4},"cited_work":{"arxiv_id":"2006.07869","doi":"10.48550/arxiv.2006.07869","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.07869","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Benchmarking multi-agent deep reinforcement learn- ing algorithms in cooperative tasks","venue":null,"work_id":"ffcc70b2-bfb7-4e18-a3a9-c4614c3bc974","year":2006},"citing_paper":{"arxiv_id":"2605.03842","last_updated":"2026-05-05T15:09:32Z","snapshot_observed_at":"2026-07-06T23:16:40.201701Z","submitted_at":"2026-05-05T15:09:32Z","title":"SOAR: Real-Time Joint Optimization of Order Allocation and Robot Scheduling in Robotic Mobile Fulfillment Systems","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-07T16:29:02.730503Z"},"links":{"cited_paper":"/paper/2006.07869","citing_paper":"/paper/2605.03842"},"observation_digest":"sha256:e418551c5b5ff19085696096cfc95e3cc695ec8288d32cdee3d930abc0862b14","observation_id":"f5a7f3e5-60c2-4d85-98c8-10252cef0166","resolution":{"observed_at":"2026-05-11T23:41:17.844145Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07869","last_updated":"2021-11-09T10:42:04Z","snapshot_observed_at":"2026-07-06T09:28:53.031338Z","submitted_at":"2020-06-14T11:22:53Z","title":"Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks","version":4},"cited_work":{"arxiv_id":"2006.07869","doi":"10.48550/arxiv.2006.07869","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.07869","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Benchmarking multi-agent deep reinforcement learn- ing algorithms in cooperative tasks","venue":null,"work_id":"ffcc70b2-bfb7-4e18-a3a9-c4614c3bc974","year":2006},"citing_paper":{"arxiv_id":"2605.08391","last_updated":"2026-05-19T01:58:16Z","snapshot_observed_at":"2026-07-06T23:20:38.385189Z","submitted_at":"2026-05-08T19:00:34Z","title":"SACHI: Structured Agent Coordination via Holistic Information Integration in Multi-Agent Reinforcement Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-12T01:31:19.576223Z"},"links":{"cited_paper":"/paper/2006.07869","citing_paper":"/paper/2605.08391"},"observation_digest":"sha256:94320df5f012fcb74e53cc4499e3e1dadd21a8f2933024c0a677719e1d90b415","observation_id":"157ec0c9-259b-4e87-beed-e437935ab5cb","resolution":{"observed_at":"2026-05-12T07:56:27.325451Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07869","last_updated":"2021-11-09T10:42:04Z","snapshot_observed_at":"2026-07-06T09:28:53.031338Z","submitted_at":"2020-06-14T11:22:53Z","title":"Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks","version":4},"cited_work":{"arxiv_id":"2006.07869","doi":"10.48550/arxiv.2006.07869","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.07869","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Benchmarking multi-agent deep reinforcement learn- ing algorithms in cooperative tasks","venue":null,"work_id":"ffcc70b2-bfb7-4e18-a3a9-c4614c3bc974","year":2006},"citing_paper":{"arxiv_id":"2605.08391","last_updated":"2026-05-19T01:58:16Z","snapshot_observed_at":"2026-07-06T23:20:38.385189Z","submitted_at":"2026-05-08T19:00:34Z","title":"SACHI: Structured Agent Coordination via Holistic Information Integration in Multi-Agent Reinforcement Learning","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-20T22:34:46.440511Z"},"links":{"cited_paper":"/paper/2006.07869","citing_paper":"/paper/2605.08391"},"observation_digest":"sha256:e723271d549434de63e6cc0615001e2ce85a5bc0a14f5dcd1700732b4d8c5cbb","observation_id":"c69e52a9-7626-4c08-b9f2-7dc24462842c","resolution":{"observed_at":"2026-05-20T22:39:10.780951Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07869","last_updated":"2021-11-09T10:42:04Z","snapshot_observed_at":"2026-07-06T09:28:53.031338Z","submitted_at":"2020-06-14T11:22:53Z","title":"Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks","version":4},"cited_work":{"arxiv_id":"2006.07869","doi":"10.48550/arxiv.2006.07869","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.07869","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Benchmarking multi-agent deep reinforcement learn- ing algorithms in cooperative tasks","venue":null,"work_id":"ffcc70b2-bfb7-4e18-a3a9-c4614c3bc974","year":2006},"citing_paper":{"arxiv_id":"2605.09212","last_updated":"2026-05-09T23:14:27Z","snapshot_observed_at":"2026-07-06T23:21:21.560069Z","submitted_at":"2026-05-09T23:14:27Z","title":"Rethinking Ratio-Based Trust Regions for Policy Optimization in Multi-Agent Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-12T03:56:28.447136Z"},"links":{"cited_paper":"/paper/2006.07869","citing_paper":"/paper/2605.09212"},"observation_digest":"sha256:3bd109dcf9b6c36937b2e1bb57818d3938926ccb4311200c6f4be601c0502e8e","observation_id":"7d449fc2-f463-420e-a44e-d0e961a7747f","resolution":{"observed_at":"2026-05-12T06:51:27.936155Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07869","last_updated":"2021-11-09T10:42:04Z","snapshot_observed_at":"2026-07-06T09:28:53.031338Z","submitted_at":"2020-06-14T11:22:53Z","title":"Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks","version":4},"cited_work":{"arxiv_id":"2006.07869","doi":"10.48550/arxiv.2006.07869","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.07869","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Benchmarking multi-agent deep reinforcement learn- ing algorithms in cooperative tasks","venue":null,"work_id":"ffcc70b2-bfb7-4e18-a3a9-c4614c3bc974","year":2006},"citing_paper":{"arxiv_id":"2605.12555","last_updated":"2026-05-11T12:00:27Z","snapshot_observed_at":"2026-07-06T23:24:13.851504Z","submitted_at":"2026-05-11T12:00:27Z","title":"DelAC: A Multi-agent Reinforcement Learning of Team-Symmetric Stochastic Games","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-14T21:31:06.105461Z"},"links":{"cited_paper":"/paper/2006.07869","citing_paper":"/paper/2605.12555"},"observation_digest":"sha256:186fbf3c14f00fe4d5cc611fa32724b4e39e2cbd856d43eda3736d6f42251917","observation_id":"ff9f91cb-790d-4c46-b7d5-bbddcb5401cb","resolution":{"observed_at":"2026-05-14T21:32:59.348331Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07869","last_updated":"2021-11-09T10:42:04Z","snapshot_observed_at":"2026-07-06T09:28:53.031338Z","submitted_at":"2020-06-14T11:22:53Z","title":"Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks","version":4},"cited_work":{"arxiv_id":"2006.07869","doi":"10.48550/arxiv.2006.07869","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.07869","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Benchmarking multi-agent deep reinforcement learn- ing algorithms in cooperative tasks","venue":null,"work_id":"ffcc70b2-bfb7-4e18-a3a9-c4614c3bc974","year":2006},"citing_paper":{"arxiv_id":"2605.12655","last_updated":"2026-06-10T15:03:44Z","snapshot_observed_at":"2026-07-06T23:24:18.302402Z","submitted_at":"2026-05-12T19:01:16Z","title":"Robust Instruction Compliance in Cooperative Multi-Agent Reinforcement Learning","version":3},"reference_index":123,"source":"arxiv_source","source_observed_at":"2026-06-30T22:11:35.277901Z"},"links":{"cited_paper":"/paper/2006.07869","citing_paper":"/paper/2605.12655"},"observation_digest":"sha256:6e3b8aea66b90afafe0f1cdcdce6d8e9d8c88232d3134f20e9e9c94e550889cb","observation_id":"770d6fbe-f2d8-4eeb-9ff0-e07cbc2b3ea7","resolution":{"observed_at":"2026-06-30T22:15:05.801534Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07869","last_updated":"2021-11-09T10:42:04Z","snapshot_observed_at":"2026-07-06T09:28:53.031338Z","submitted_at":"2020-06-14T11:22:53Z","title":"Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks","version":4},"cited_work":{"arxiv_id":"2006.07869","doi":"10.48550/arxiv.2006.07869","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.07869","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Benchmarking multi-agent deep reinforcement learn- ing algorithms in cooperative tasks","venue":null,"work_id":"ffcc70b2-bfb7-4e18-a3a9-c4614c3bc974","year":2006},"citing_paper":{"arxiv_id":"2605.18024","last_updated":"2026-05-29T10:46:49Z","snapshot_observed_at":"2026-07-06T23:28:55.079333Z","submitted_at":"2026-05-18T08:14:38Z","title":"Interaction-Breaking Adversarial Learning Framework for Robust Multi-Agent Reinforcement Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T18:47:09.501908Z"},"links":{"cited_paper":"/paper/2006.07869","citing_paper":"/paper/2605.18024"},"observation_digest":"sha256:9f313889d3a8ef7f370f1a744d70adc1f6ad2b46e102835647d2191dabf7b9ba","observation_id":"e1cb1706-5baf-4eb1-a04f-d320dfcec8e3","resolution":{"observed_at":"2026-06-30T18:55:00.849588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07869","last_updated":"2021-11-09T10:42:04Z","snapshot_observed_at":"2026-07-06T09:28:53.031338Z","submitted_at":"2020-06-14T11:22:53Z","title":"Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks","version":4},"cited_work":{"arxiv_id":"2006.07869","doi":"10.48550/arxiv.2006.07869","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.07869","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Benchmarking multi-agent deep reinforcement learn- ing algorithms in cooperative tasks","venue":null,"work_id":"ffcc70b2-bfb7-4e18-a3a9-c4614c3bc974","year":2006},"citing_paper":{"arxiv_id":"2605.25867","last_updated":"2026-05-25T13:56:02Z","snapshot_observed_at":"2026-07-06T23:35:46.157653Z","submitted_at":"2026-05-25T13:56:02Z","title":"CINOC: Cardinality-Invariant Neural Operator Policies for Scalable PDE Control","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T20:44:11.206380Z"},"links":{"cited_paper":"/paper/2006.07869","citing_paper":"/paper/2605.25867"},"observation_digest":"sha256:39c55fb6654228efafd5446558d4ad1ed24e701eda6f8761fdfa4f2eaa53309f","observation_id":"c4ee1119-6609-4df4-8ed3-0d9c52a498cc","resolution":{"observed_at":"2026-06-29T21:03:58.925631Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07869","last_updated":"2021-11-09T10:42:04Z","snapshot_observed_at":"2026-07-06T09:28:53.031338Z","submitted_at":"2020-06-14T11:22:53Z","title":"Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.07869","snapshot_observed_at":"2026-07-13T07:38:02.368884Z","title":"arXiv preprint arXiv:2006.07869 (2020)","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2606.14130","last_updated":"2026-07-09T21:57:35Z","snapshot_observed_at":"2026-07-30T21:50:08.262546Z","submitted_at":"2026-06-12T05:30:53Z","title":"Contract-Based Compositional Shielding for Safe Multi-Agent Reinforcement Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-13T07:38:02.368884Z"},"links":{"cited_paper":"/paper/2006.07869","citing_paper":"/paper/2606.14130"},"observation_digest":"sha256:cd66a7469700242cb3285e2bd96ce8c34ff9bc5802ca31952d2c1cb3f8c97e10","observation_id":"2b652c66-58f8-49d2-b7ac-07efb65f00d1","resolution":{"observed_at":"2026-07-13T07:38:02.368884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07869","last_updated":"2021-11-09T10:42:04Z","snapshot_observed_at":"2026-07-06T09:28:53.031338Z","submitted_at":"2020-06-14T11:22:53Z","title":"Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks","version":4},"cited_work":{"arxiv_id":"2006.07869","doi":"10.48550/arxiv.2006.07869","metadata_source":"arxiv_reference","pith_arxiv_id":"2006.07869","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Benchmarking multi-agent deep reinforcement learn- ing algorithms in cooperative tasks","venue":null,"work_id":"ffcc70b2-bfb7-4e18-a3a9-c4614c3bc974","year":2006},"citing_paper":{"arxiv_id":"2606.25526","last_updated":"2026-06-24T08:05:11Z","snapshot_observed_at":"2026-07-06T23:59:57.346004Z","submitted_at":"2026-06-24T08:05:11Z","title":"Low Variance Trust Region Optimization with Independent Actors and Sequential Updates in Cooperative Multi-agent Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-25T21:17:28.832301Z"},"links":{"cited_paper":"/paper/2006.07869","citing_paper":"/paper/2606.25526"},"observation_digest":"sha256:74b39c7d29260a475ac6bd26c6a7c75063ad0e6051fd1b4ff6747037a54acbd9","observation_id":"e311621e-b17b-4d73-ae61-dd336cf0c76e","resolution":{"observed_at":"2026-07-04T19:30:07.589674Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-31T06:34:12.847434+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2006.07869/citation-record","integrity":"/paper/2006.07869/integrity","json":"/paper/2006.07869/citation-record.json","paper":"/paper/2006.07869"},"outbound":[],"paper":{"arxiv_id":"2006.07869","last_updated":"2021-11-09T10:42:04Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T09:28:53.031338Z","submitted_at":"2020-06-14T11:22:53Z","title":"Benchmarking Multi-Agent Deep Reinforcement Learning Algorithms in Cooperative Tasks"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-07-31T06:34:12.847434+00:00","source":"crossref"},{"observed_at":"2026-07-31T06:34:08.642788+00:00","source":"retraction_watch"}],"thesis":"As of 31 July 2026, this Paper Citation Record lists 0 of 0 outbound references and 16 inbound Pith citation observations for arXiv:2006.07869."}