{"as_of":"2026-08-22T01:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:22b0a891146fca3cc8386c1bafd4b799deea726d9f9eb750c27344e6e473737e","coverage":[{"denominator":81,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":81,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T19:18:56.039587Z","state":"measured"},{"denominator":82,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":82,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T15:25:39.314247Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-10T05:30:23.456663Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-10T05:30:23.456663Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"cited_work":{"arxiv_id":"2606.08340","doi":"10.48550/arxiv.2606.08340","metadata_source":"pith","pith_arxiv_id":"2606.08340","snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","venue":"cs.AI","work_id":"d3233d28-0fc9-4021-b40d-0eca7deebbbb","year":2026},"citing_paper":{"arxiv_id":"2608.03644","last_updated":"2026-08-04T13:29:00Z","snapshot_observed_at":"2026-08-18T16:50:46.109145Z","submitted_at":"2026-08-04T13:29:00Z","title":"Is Inter-Seed Cross-Play Enough? Evaluating the Robustness of Zero-Shot Coordination Algorithms to Implementation Details","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T15:25:39.314247Z"},"links":{"cited_paper":"/paper/2606.08340","citing_paper":"/paper/2608.03644"},"observation_digest":"sha256:f3c1d6c75e26f5394d8842d663ecf3e84930d33f8616e121652e9c7b4449799f","observation_id":"d040f47b-37ae-4a37-a8ee-81dee79bd2f7","resolution":{"observed_at":"2026-08-05T15:28:46.299124Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2606.08340/citation-record","integrity":"/paper/2606.08340/integrity","json":"/paper/2606.08340/citation-record.json","paper":"/paper/2606.08340"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2211.13746","last_updated":"2023-10-31T00:06:14Z","snapshot_observed_at":"2026-08-16T16:13:31.912598Z","submitted_at":"2022-11-24T18:23:28Z","title":"Melting Pot 2.0","version":6},"cited_work":{"arxiv_id":"2211.13746","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.13746","snapshot_observed_at":"2026-07-09T10:26:11.053924Z","title":"Melting pot 2.0","venue":"cs.MA","work_id":"761894c7-1b77-465a-92be-fe5819372cd7","year":2022},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"cited_paper":"/paper/2211.13746","citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:56275c373be6d4d55274e163fb89e5de1015d2599b2794e0ce1e417137d87082","observation_id":"f7a5f70c-ba09-48b8-ac61-afd210f3f65b","resolution":{"observed_at":"2026-07-02T22:07:25.837587Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Deep reinforcement learning at the edge of the statistical precipice.Advances in Neural Information Processing Systems, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:178ac94f133033facee9be7b167a3eba664014186e45e795524068790f188c09","observation_id":"50d813f5-5692-4c5d-bd47-706b88e236c0","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Llm-coordination: evaluating and analyzing multi-agent coordination abilities in large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:21c46906b5da3338eab08baaa65c2aeff7ca8616ecf61f7b2203f82a0faa8fa4","observation_id":"b59aa67e-4c3e-4ef6-9122-dcf7dc512583","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"The hanabi challenge: A new frontier for ai research.Artificial Intelligence, 280:103216, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:da55bc24faffc6dcd02a63457d76ca29ade9f0470506d21df9302fd11a18fb97","observation_id":"8db17a47-ad0b-4236-b701-0bae4c2f5bc4","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"The arcade learning environment: An evaluation platform for general agents.Journal of artificial intelligence research, 47:253–279, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:55ca97c8386060a44dc56954e793a93a99c197d08fe82f906936b9c8fc0e77e6","observation_id":"803e569b-d1ab-4ba3-94b6-bc9fddcb0dcc","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"JAX: composable transformations of Python+NumPy programs, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:37502770bf84f6b4953e9d2a8f8408455d7edcf42fff9cc550837b1053b78f4d","observation_id":"c514a66b-27d8-4ed0-af8e-14ce846ac99e","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Superhuman ai for heads-up no-limit poker: Libratus beats top professionals.Science, 359(6374):418–424, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:ee59a64e5b4bf2ab746bc84ac099834eb76906aae0ba433143f3c270fa578b22","observation_id":"26c9b99c-9012-4622-a9d5-e36cf6f0ae91","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Language models are few-shot learners.Advances in neural information processing systems, 33:1877–1901, 2020","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:11cd294221513432d1346d17da99971567b84b8257c9b00da7b5a9ddeca8cfdc","observation_id":"2c1b7b02-577f-4e52-ae4d-07d4ed26a3f6","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Deep blue.Artificial intelligence, 134(1-2):57–83, 2002","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:1c6912ea48763126c2171a7524678658deec090033a413ca67f23a745206a39a","observation_id":"3220a018-d7c7-4453-864a-b777d31e1d42","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"On the utility of learning about humans for human-ai coordination.Advances in neural information processing systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:6949b8f6891301caa89ea90f5e00f408c5836ec08df05bf6afccd2057e577280","observation_id":"847bc0f1-5d20-4c7d-bc1c-256753e091e3","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"MLE-bench: Evaluating machine learning agents on machine learning engineering","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:7da540089a785bc0794c83c1261859ce43d7ba4c7504fe0e5e03aa50de9133dc","observation_id":"eef40610-6b56-42f6-bcb7-caf2542005c9","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-19T03:09:02.515007Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":"2011.09533","doi":"10.48550/arxiv.2011.09533","metadata_source":"arxiv_reference","pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Gupta, T., Makoviichuk, D., Makoviychuk, V ., Torr, P","venue":"arXiv (Cornell University)","work_id":"74cea5c0-e9e0-4389-9a11-5c905c1db3e8","year":2011},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:c7ceaac115e732f6c455e76ec8355f16030918cc73421f0331a74df9aaef3398","observation_id":"25717b9d-3024-4e1f-be48-7c30eb504949","resolution":{"observed_at":"2026-07-02T22:07:25.850015Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:a4eda9e03eeece48d456937a8da4927755720ce510934c4527e10279f6bf10a5","observation_id":"022147d5-e39f-4f92-a6fe-d46d39ef1861","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Improv- ing factuality and reasoning in language models through multiagent debate","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:88cf6b68ffbdd8381619848aff4eb6d21006250a24c84f18147437549c9e0ad8","observation_id":"6135fc64-bbc0-45cb-a220-e6507f5fa373","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Smacv2: An improved benchmark for cooperative multi-agent reinforcement learning.Advances in Neural Information Processing Systems, 36:37567–37593, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:6ab821bc217dc2031e3a2d846ebd1458022d3aac5b339fc4497a1e178941b546","observation_id":"a1bdd995-3ba6-4820-9b00-385280459451","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Simplifying deep temporal difference learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:871282480126d92a7263d38efe40252311e90a12369eeb8b225824d9cb1c83ad","observation_id":"4b2b49d0-aace-4643-834d-4def46249717","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Overcookedv2: Rethinking overcooked for zero-shot coordination","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:9b0d2682245f750c096373b8917e0fbe65d2fd7852fff51061b8595d149fcf3f","observation_id":"f0b3de9c-05b8-4e14-8dce-40942b4e84fa","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Gemini 3.1 pro model card","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:8ba3cec437b2851ab22e7ad04412c60a47e8cb9dc16251d7c02ca761b7d992c5","observation_id":"763b77cd-2070-4a74-88b2-85bf9692f2af","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Gemma 4 model card","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:6baccec56b048c5c5cd0fa178562f09207d2e966baea8e72a75cc751c5c30ffa","observation_id":"ac242237-0a68-44d5-881c-fcc2c989b991","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.27865","last_updated":"2026-04-30T13:47:22Z","snapshot_observed_at":"2026-08-13T18:12:24.887934Z","submitted_at":"2026-04-30T13:47:22Z","title":"KellyBench: A Benchmark for Long-Horizon Sequential Decision Making","version":1},"cited_work":{"arxiv_id":"2604.27865","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.27865","snapshot_observed_at":"2026-07-10T16:57:24.558040Z","title":"KellyBench: A Benchmark for Long-Horizon Sequential Decision Making","venue":"cs.AI","work_id":"5f2855f1-f1d3-4ee1-9dbf-23475f540b79","year":2026},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"cited_paper":"/paper/2604.27865","citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:6099cce162c17e3ee99f3350f9c87bc4943a18e88a3314a66be0e30f6fb55432","observation_id":"ed9eee9c-c55a-4f6d-8bad-2081d0459431","resolution":{"observed_at":"2026-07-02T22:07:25.852225Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:7ab28fc1854426c3f5092be6bb38c7012f386d2180fdc2a7436a2ab33e1cbe09","observation_id":"7a87bf2f-8fab-406b-878b-458a0116a3fd","resolution":{"observed_at":"2026-07-02T22:07:25.834809Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.08616","last_updated":"2025-07-11T14:13:22Z","snapshot_observed_at":"2026-08-17T22:35:33.284853Z","submitted_at":"2025-07-11T14:13:22Z","title":"AgentsNet: Coordination and Collaborative Reasoning in Multi-Agent LLMs","version":1},"cited_work":{"arxiv_id":"2507.08616","doi":"10.48550/arxiv.2507.08616","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.08616","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agentsnet: Coordination and collaborative reasoning in multi-agent llms","venue":"arXiv (Cornell University)","work_id":"35aea679-ba18-4cfd-a1f8-951c9f55e601","year":2025},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"cited_paper":"/paper/2507.08616","citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:f039190dd21b1e4273245a23fd81c30fb6cff6c74aab2f42e7cc913aeaf236cc","observation_id":"7fea0335-8c3f-4c5b-a5e3-6f1af02faf90","resolution":{"observed_at":"2026-07-02T22:07:25.843950Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Large language model based multi-agents: a survey of progress and challenges","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:bfb1578624ae9476a891ef854597da5394be2fa1fdc2ecc5cfc1a92b7a774bdd","observation_id":"cb811d90-d298-45cc-9c56-231bf212d622","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Benchmarking the spectrum of agent capabilities","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:72ee36b7e13466bf6ef6b55639aba5f76bca9771814cf72cc5ba72bb208863cb","observation_id":"2a159151-40fd-4730-b126-e7f4f75c37c3","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14143","last_updated":"2025-02-19T23:03:21Z","snapshot_observed_at":"2026-08-19T21:01:37.379168Z","submitted_at":"2025-02-19T23:03:21Z","title":"Multi-Agent Risks from Advanced AI","version":1},"cited_work":{"arxiv_id":"2502.14143","doi":"10.48550/arxiv.2502.14143","metadata_source":"pith","pith_arxiv_id":"2502.14143","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2502.14143 , year=","venue":"cs.MA","work_id":"5c63297e-2866-40b6-878d-2bdbe3c0fdc7","year":2025},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"cited_paper":"/paper/2502.14143","citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:55c88f2035fd13d9e95796f2c32ae84cbe6b90f7397a3b2093b707c98a366c38","observation_id":"74079e33-86fe-41f0-82d1-e538efce29c1","resolution":{"observed_at":"2026-07-02T21:57:25.939633Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-07-15T18:20:35.094728+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T18:20:35.094728+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Dynamic programming for partially observable stochastic games","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:80dbdabeb768cdd076a993b76be3d66cdbb331b2215f1f5b2b2b62c6465b1d86","observation_id":"8103005f-0ba4-451f-b42e-564e88c0f201","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2604.01212","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T21:38:58.690110Z","title":"YC-Bench : Benchmarking AI agents for long-term planning and consistent execution","venue":null,"work_id":"231c9526-d283-40bc-a797-92cb879e61a9","year":2026},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:08038cd19247182b42bd5caefcbf48720ed92ebc3cd1f02e018f04b4acc16a9f","observation_id":"eaccb156-1623-4f79-93e9-2a856c7576e0","resolution":{"observed_at":"2026-07-02T21:57:25.942643Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Metagpt: Meta programming for a multi-agent collaborative framework","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:2d83ace721949028325dc7fec76bf0e5db4e7d7e8c2e3b4ae2a568f4832ff309","observation_id":"d42b5e69-1652-4223-9b57-095a253cbf05","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Position: Open-endedness is essential for artificial superhuman intelligence","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:052fea57b2359c07665eea648e95ddd2b3c2656a94fcb91bcef7317ffcef99d0","observation_id":"2954ecfb-c452-4f81-beb9-d58126a60d2a","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01584","last_updated":"2025-02-18T14:09:38Z","snapshot_observed_at":"2026-08-16T13:28:51.598694Z","submitted_at":"2024-08-02T21:37:46Z","title":"GPUDrive: Data-driven, multi-agent driving simulation at 1 million FPS","version":3},"cited_work":{"arxiv_id":"2408.01584","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.01584","snapshot_observed_at":"2026-07-04T06:49:38.028458Z","title":"Gpudrive: Data-driven, multi-agent driving simulation at 1 million fps","venue":null,"work_id":"d7082c39-b299-48e9-a0fd-b2bbcdcabe1e","year":2024},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"cited_paper":"/paper/2408.01584","citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:b380fdebcc4297789991e33e2dd175e74f09b8b0f2b048b6cf0765fc1f7019d7","observation_id":"00930267-5a84-40ed-864c-64ba1f10a56d","resolution":{"observed_at":"2026-07-02T22:07:25.846756Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14499","last_updated":"2026-07-10T21:48:09Z","snapshot_observed_at":"2026-08-16T12:48:53.169158Z","submitted_at":"2025-03-18T17:59:31Z","title":"Measuring AI Ability to Complete Long Software Tasks","version":4},"cited_work":{"arxiv_id":"2503.14499","doi":"10.48550/arxiv.2503.14499","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.14499","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Robert Tjarko Lange, Yuki Imajuku, and Edoardo Cetin","venue":"arXiv (Cornell University)","work_id":"37da2963-7822-4d51-9aa5-d4a11d757e36","year":2025},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"cited_paper":"/paper/2503.14499","citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:65588f65498cb9bb8b0d6149b2cc3e1a90fc4f8688783e049c278b2d8220657f","observation_id":"11c58ef6-bf05-4360-8048-055cc3656be6","resolution":{"observed_at":"2026-07-14T01:19:52.953392Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Efficient memory management for large language model serving with pagedattention","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:da8bcab9ecb1e879b0f8433be5ce04480ddc893bdcdd373486c796a34c90574d","observation_id":"cb55698a-3642-4f69-a387-ebad98254270","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Scalable evaluation of multi-agent reinforcement learning with melting pot","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:72df079c850683766dc549c18d045b5d33b54ccc9a5f5f89927e2cee735b17f7","observation_id":"3231cd7d-1a90-49ba-a6ac-8b504e7f6514","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Stateful active facilitator: Co- ordination and environmental heterogeneity in cooperative multi-agent reinforcement learn- ing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:84f1a7b2b6136f7674d6d792edf52775592708225474c08b89ba6aa1abfcb7df","observation_id":"a0b1e157-6a7b-47d7-ab2f-72a9963c013c","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Towards end-to-end automation of ai research.Nature, 651(8107):914–919, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:6316e97c560d686707adc07696b3b02ca17e9d843b3668d98313861a55568ae6","observation_id":"ea4881bd-221b-4779-b1f3-0ead8873bd02","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"The interdisciplinary study of coordination.ACM Computing Surveys (CSUR), 26(1):87–119, 1994","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:1b268fd4471cd6f099cd64f43741daef82aa9e6292187fe6c099c8bb9c0a9d0a","observation_id":"1bbad8e0-454f-40cd-8511-8eabfabaaaea","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Craftax: A lightning-fast benchmark for open-ended reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:5c6ef526cf17ddc717215a479490eebf99e847dcbc240354e19af8fc213d1ee2","observation_id":"98dcb019-0380-425d-b8e9-03780327c2e2","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"The influence of scaffolds on coordination scaling laws in LLM agents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:1a7067638ce1d99e07c9fa155953efd426f10f761e9173e124ff69bc0fb80345","observation_id":"3f21675e-7647-4bf3-ae90-000a2509a9af","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:72f85cec05a58d46b41f9732c1ba8079bee0098ea0694e8ea568a9a5a796a6b4","observation_id":"4ddd6292-8c34-4cfd-a64a-695761e9a01f","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.09332","last_updated":"2022-06-01T19:08:11Z","snapshot_observed_at":"2026-08-19T02:54:55.334346Z","submitted_at":"2021-12-17T05:43:43Z","title":"WebGPT: Browser-assisted question-answering with human feedback","version":3},"cited_work":{"arxiv_id":"2112.09332","doi":"10.48550/arxiv.2112.09332","metadata_source":"pith","pith_arxiv_id":"2112.09332","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WebGPT: Browser-assisted question-answering with human feedback","venue":"cs.CL","work_id":"e25ef3e1-4848-4cb9-bf28-67a420591165","year":2021},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"cited_paper":"/paper/2112.09332","citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:3add132449e500be7d03998644d4c47ad5a559cad7307ea16f7116cf2082b00a","observation_id":"6db07c23-3a1c-4dfc-9b1b-f2cbd4fbba87","resolution":{"observed_at":"2026-07-02T21:57:26.474953Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:09.995583+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:09.995583+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.04904","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T21:57:26.485284Z","title":"Multi- agent craftax: Benchmarking open-ended multi-agent reinforcement learning at the hyperscale","venue":null,"work_id":"c634ed69-b359-497f-8289-c55d81aee87f","year":2025},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:4865dfcc420c6ea0c8467cef84270361a4544844493f09b974c6bc926b641060","observation_id":"7045ef07-23ee-41f0-960c-2a54d2f7f4a1","resolution":{"observed_at":"2026-07-02T21:57:26.486842Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Introducing gpt-5.4","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:7a0e6aa36bfbc9ffaf035320eab776f54bd9b693a023d843dd0cc1aff10b68c9","observation_id":"91de4d21-d495-49df-9d57-95f0bcbf6899","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"BALROG: Benchmarking agentic LLM and VLM reasoning on games","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:1af34b8c5d0c6c5495eff37b2e592098c8ac38914967a83cf1b70eb7478e32e3","observation_id":"3ff00003-78e0-46bc-aac7-a6fe72926969","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:d18921aecfaf759a2a4853eea92ab8c2ea91ffdffd089a92f571061f61800a36","observation_id":"fbfde19b-9397-4bd9-8672-af4f9cac20f3","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Qwen3.6-Plus: Towards real world agents, April 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:4bc6b6b8dc1a4b72c5307aaebdcdec5a7e121e9b0667a61092aa5b9043d1026c","observation_id":"fec06b1e-d3ae-47ea-b106-0d6b4559e6b5","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Jaxmarl: Multi-agent rl environments and algorithms in jax.Advances in Neural Information Processing Systems, 37:50925–50951, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:cb0b41480e1a0fd67ca34ffda8c8de512c9f7f6481ba42e22b21f544ed224be4","observation_id":"887ce479-2103-414e-8e5e-2161f6e6315d","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:3627ae7a38a5b261b24c53a92d837ac3aa266b28f1b863fe61315b2e77452677","observation_id":"b8f1c05c-71bf-4509-ac57-355352c23984","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Harvard university press, 1980","venue":null,"work_id":null,"year":1980},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:21457b6c44ac63aa4ce0669ac85725a403164a575f58aecddeba17dcdaab5b2d","observation_id":"5c34c920-297c-4d37-a20c-7b16900e83de","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Mastering atari, go, chess and shogi by planning with a learned model.Nature, 588(7839):604–609, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:e44d0937970abdb6328902ef7fe4ad96a0d4a0eff55a63f36e60cfbf9d045943","observation_id":"6fee729b-d76e-4edc-8263-13d70f66793c","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"The illusion of thinking: Understanding the strengths and limitations of reasoning models via the lens of problem complexity","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:08b237078b19b29bf7f25a2286cdbf2b5ca07459650bd1c4398df1b77f4417d4","observation_id":"2f382997-0879-47c2-9126-2cbad57a8a90","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"The illusion of diminishing returns: Measuring long horizon execution in LLMs","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:a3e530fe133a44476741c98ddfccd5bcc0eb1547f0572480215a11a4c711b50c","observation_id":"bee96ae7-7e58-4c62-b5d5-68ff8da78311","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Cambridge University Press, 2004","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:e195ed890bd1102ba14ef82c9f2568b00e4f8a2a60233c771ec6576837c637ec","observation_id":"f25956c3-aaa5-4824-9764-fbe7fcad84bc","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.00784","last_updated":"2019-03-02T22:42:33Z","snapshot_observed_at":"2026-08-17T17:10:31.936743Z","submitted_at":"2019-03-02T22:42:33Z","title":"Neural MMO: A Massively Multiagent Game Environment for Training and Evaluating Intelligent Agents","version":1},"cited_work":{"arxiv_id":"1903.00784","doi":null,"metadata_source":"pith","pith_arxiv_id":"1903.00784","snapshot_observed_at":"2026-07-02T21:57:26.478675Z","title":"Neural MMO: A Massively Multiagent Game Environment for Training and Evaluating Intelligent Agents","venue":"cs.MA","work_id":"6bf990ed-45e1-402f-9f7f-357199a0c8db","year":2019},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"cited_paper":"/paper/1903.00784","citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:d74dade205814d44f4361802feba88d321340ecd835c7290cedc9fc24efddf7f","observation_id":"fae28ccf-f4c9-4696-a22f-fa22e3edcdd3","resolution":{"observed_at":"2026-07-02T21:57:26.480037Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Neural mmo 2.0: a massively multi-task addition to massively multi-agent learning.Advances in Neural Information Processing Systems, 36:50094–50104, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:9aa876a8f902ea3d15930f4685510cb6e741a5faca6ec990efa7d66f03764fbf","observation_id":"40972b0c-6593-462d-ba9b-1334d739ad61","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Collab-overcooked: Benchmarking and evaluating large language models as collaborative agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:312fad08babdaf2a1692f96838c2a731485bdabd98d55c071fd93a0071b63846","observation_id":"318fe340-a567-4ca8-915e-c2fc3385273e","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Qwen3.5: Accelerating productivity with native multimodal agents, February","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:e101b0fee55400c7208a0a130d305d8a320808f3b98f9b2fc0af712882d75774","observation_id":"1e7e5c25-6426-41dd-aed2-1e926467d02a","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:cb958ce85be1757b09ae648c59f9f9568955dca423c04f990dae4890d6a48d3c","observation_id":"19d16a19-f1bd-4a6c-88c6-095781dc2e74","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Hypermarl: Adaptive hypernetworks for multi-agent rl","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:ebb6eb0cd5e58c1edd3417c3d48cc385bc87b136cfcbede09313c6aa9ea2a5e4","observation_id":"9e23311f-45df-46a4-af54-b6879e8a4fdf","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Probing dec-POMDP reasoning in cooperative MARL","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:3f99ded41759ec6b4a33119d24f6b22d379e7e1b00acd7ba0141c6bea893d906","observation_id":"99b49b6b-a53a-45ef-9b26-ab105b49b0a2","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Attention is all you need.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:a73f021cd2d559b0e6aabceb069978ff9b4238647aebf75abe15c503cee16218","observation_id":"3f88a188-cc22-4713-a1aa-dc06d4ebe76a","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Grandmaster level in starcraft ii using multi-agent reinforcement learning.nature, 575(7782):350–354, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:fe26f8412cb13e6f98cf0dee5d762578dec132af964f904d3f0d8d4e6255720c","observation_id":"2e385151-8669-4fd3-8c19-063af38846e0","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"V oyager: An open-ended embodied agent with large language models.Transactions on Machine Learning Research, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:a24219307095074e4c1b600f0b099190c79995a6270ca3c79fde3ef3b463171a","observation_id":"12aef7d2-b64b-44cb-858d-10f963bccb3c","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15971","last_updated":"2024-08-28T17:43:55Z","snapshot_observed_at":"2026-08-16T13:23:07.998172Z","submitted_at":"2024-08-28T17:43:55Z","title":"BattleAgentBench: A Benchmark for Evaluating Cooperation and Competition Capabilities of Language Models in Multi-Agent Systems","version":1},"cited_work":{"arxiv_id":"2408.15971","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.15971","snapshot_observed_at":"2026-07-02T22:57:26.233385Z","title":"Battleagentbench: A benchmark for evaluating cooperation and competition capabilities of language models in multi-agent systems.arXiv preprint arXiv:2408.15971","venue":null,"work_id":"17ce7da6-3ca0-4fb9-af61-311cc7c0d2e0","year":2024},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"cited_paper":"/paper/2408.15971","citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:18334512178936e3ab4274a578e500aa7d6e21f0674083491f5f0bc88842eed3","observation_id":"54db5e46-b1ba-41bb-82a2-6991ed0d43bc","resolution":{"observed_at":"2026-07-02T21:57:26.483468Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09124","last_updated":"2025-08-12T17:53:03Z","snapshot_observed_at":"2026-08-20T11:21:24.095471Z","submitted_at":"2025-08-12T17:53:03Z","title":"OdysseyBench: Evaluating LLM Agents on Long-Horizon Complex Office Application Workflows","version":1},"cited_work":{"arxiv_id":"2508.09124","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.09124","snapshot_observed_at":"2026-07-11T01:37:42.801023Z","title":"OdysseyBench: Evaluating LLM Agents on Long-Horizon Complex Office Application Workflows","venue":"cs.CL","work_id":"061edd26-53a3-4802-a464-5ce90e859239","year":2025},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"cited_paper":"/paper/2508.09124","citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:81a372942d59893167a9a6b557a3217efb5813a07f6c62472edfad2971d7e313","observation_id":"2fb866c7-3830-4bb4-b3fb-a9ecb1dd1d5a","resolution":{"observed_at":"2026-07-02T21:57:26.489813Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08066","last_updated":"2025-04-10T18:44:41Z","snapshot_observed_at":"2026-08-10T03:18:36.275195Z","submitted_at":"2025-04-10T18:44:41Z","title":"The AI Scientist-v2: Workshop-Level Automated Scientific Discovery via Agentic Tree Search","version":1},"cited_work":{"arxiv_id":"2504.08066","doi":"10.48550/arxiv.2504.08066","metadata_source":"pith","pith_arxiv_id":"2504.08066","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The AI Scientist-v2: Workshop-Level Automated Scientific Discovery via Agentic Tree Search","venue":"cs.AI","work_id":"fa04f346-ee20-4e9d-bf04-3ad3569a8ed1","year":2025},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"cited_paper":"/paper/2504.08066","citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:056fecb9104bd695608068603a478da0fbcbfde1d944cd35762d3853f2771db0","observation_id":"cb41eca6-8e69-42cd-b10a-5246adfd5b41","resolution":{"observed_at":"2026-07-02T21:57:26.492973Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-05-25T19:23:27.206897+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T19:23:27.206897+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"LLM- powered decentralized generative agents with adaptive hierarchical knowledge graph for co- operative planning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:c344349aa67e083f3e2892bad8b04e9ca5d1ce4feba3d36458650a223d2cd00b","observation_id":"268c12ed-7f4c-4f93-a7f8-a60d6bbb6580","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"React: Synergizing reasoning and acting in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:c6c3f880145bccdc901a112bcdbc5e1efc2c2a9af63a351e7d46df82d6ecccf0","observation_id":"519dafca-3ff6-448c-a57a-f305f7f4144c","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15679","last_updated":"2025-08-21T15:59:20Z","snapshot_observed_at":"2026-08-15T14:53:45.666011Z","submitted_at":"2025-08-21T15:59:20Z","title":"An Efficient Open World Environment for Multi-Agent Social Learning","version":1},"cited_work":{"arxiv_id":"2508.15679","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.15679","snapshot_observed_at":"2026-07-02T21:57:26.476025Z","title":"An efficient open world environment for multi-agent social learning","venue":null,"work_id":"f1bb5eea-acd7-49a1-934a-d9c2988d8b4e","year":2025},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"cited_paper":"/paper/2508.15679","citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:4e830790733209329b742b905cb2ec1df1ad278478cfe4ba1c370f77252a58d4","observation_id":"043edb4e-f88b-4561-a60c-2f835456b35f","resolution":{"observed_at":"2026-07-02T21:57:26.477512Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"The surprising effectiveness of ppo in cooperative multi-agent games.Advances in neural information processing systems, 35:24611–24624, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:857e38080c7e73956ed2aa9c36cfd9da10b552aedf5b9a3b96ad73a3d4e426be","observation_id":"65f49f67-45dd-44b8-acdc-022a66b3e71c","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.18137","doi":"10.48550/arxiv.2601.18137","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yinger Zhang, Shutong Jiang, Renhao Li, Jianhong Tu, Yang Su, Lianghao Deng, Xudong Guo, Chenxu Lv, and Junyang Lin","venue":"arXiv (Cornell University)","work_id":"cc7d23ab-0451-4d0e-8ea2-9a2a8e1512c7","year":2026},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:9d7862923ad0a0ef811dd35c007fa019924a4b1a0bd16727827ab75d0ff08153","observation_id":"6cc8f711-ba8f-4f87-abde-556685233499","resolution":{"observed_at":"2026-07-02T21:57:25.945763Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.22769","last_updated":"2026-05-27T09:28:43Z","snapshot_observed_at":"2026-08-15T09:53:44.944732Z","submitted_at":"2026-02-26T08:59:31Z","title":"AMA-Bench: Evaluating Long-Horizon Memory for Agentic Applications","version":4},"cited_work":{"arxiv_id":"2602.22769","doi":"10.48550/arxiv.2602.22769","metadata_source":"pith","pith_arxiv_id":"2602.22769","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ama-bench: Evaluating long-horizon memory for agentic llms","venue":"cs.AI","work_id":"511e9b37-73a4-4ced-9b91-1bc2798c3c5c","year":2026},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"cited_paper":"/paper/2602.22769","citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:3f21e441809900741727e7da8ac5ffa7c5053318933545acb58eada6eea18013","observation_id":"23c1e0b0-0674-4e00-888f-1ae0fe52be74","resolution":{"observed_at":"2026-07-02T22:07:25.841029Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Multiagentbench: Evaluating the collaboration and competition of llm agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:1d9f2cf1998ab3cd286ed116e35ff7a359bb736a70f025dc72332c27d76f167f","observation_id":"5be93d94-2e6f-484e-8c63-3d311130b72f","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"By default it also optionally includes the full action catalogue with natural-language descriptions, game and coordination mechanics","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:04e2b212623a5a7025f4f00d57bac9f0e73006250dfa0f73019610460a6c5644","observation_id":"c93ba9b5-378b-43f3-bcaf-26a3b6d9c128","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Observation from k step(s) ago","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:d3cd36bc447703e186e4fb2d41ca29afeb888f45acbbcee7fe7197cb7a7bb408","observation_id":"7aa8abb5-ca0c-4529-9124-7295b191e3d1","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"The agent is then prompted to respond with an action","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:9cfe68915f2c4de3a5220eb294e6b50d13d0311eb21dbba4e89c5076d0dde8e0","observation_id":"f96908de-3996-4cbb-abe3-a9e558bcc3d1","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:189a3081bfa764b2e1565eb329a35b00043b7cfba6f22b03365ab8f9aaf799ec","observation_id":"686764f3-2877-49a3-a676-07e2aae58d08","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:d9803ef0401340af4f338106c6d34e4f93be4279927101e60678ecd1418e9dfd","observation_id":"d25e8562-2e63-4b6b-bd42-07e8474d4c1e","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"The ladder only becomes usable after enough monsters on that level have been killed","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:a654f64ddc4008e3afa0d02f074e81b02ee81d25ed7f62b0c95503b6164d6aaa","observation_id":"9fb18d4c-5910-40fb-913e-01172986b31e","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:01a93ef8d7e9bdaf4c186c937b263b83030c3f2a32cff9d0e2637386ebb0962f","observation_id":"222ddb51-b827-4e46-92d8-581257202220","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"Teammates can only act on what you tell them","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:1e51cf43591b51d9b3130c9ee475fe58ad3c36d5e9ac18cd075f0e9a612581ea","observation_id":"4b25005e-4955-47b8-af2b-951272fa3635","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T19:18:56.039587Z","title":"TN: ” or “TurnN:","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-06-27T19:18:56.039587Z"},"links":{"citing_paper":"/paper/2606.08340"},"observation_digest":"sha256:88a00142943e890a3f2a8b8c2c12d5c2cf9da5c90edbce831b7a21c56fc959a7","observation_id":"fe74fa9e-167e-482e-8370-86032dbbc114","resolution":{"observed_at":"2026-06-27T19:18:56.039587Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.08340","last_updated":"2026-06-06T21:13:43Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-14T08:55:02.226911Z","submitted_at":"2026-06-06T21:13:43Z","title":"Benchmarking Open-Ended Multi-Agent Coordination in Language Agents"},"reference_resolution":{"displayed":81,"state_counts":{"malformed_identifier":2,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":61,"verified_exact":15,"verified_fuzzy":0},"total_outbound_references":81},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 81 of 81 outbound references and 1 inbound Pith citation observation for arXiv:2606.08340."}