{"as_of":"2026-08-07T10:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9609d3bf1d951e246a4ec2569b8c8bc6e9e133773340760c896093820d893ffa","coverage":[{"denominator":123,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T05:42:57.561468Z","state":"measured"},{"denominator":200,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":200,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":163,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:48:12.357777Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":11,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-07T00:48:12.357777Z","title":"Pan, Shuyi Yang, Lakshya A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12594","last_updated":"2025-06-14T18:19:05Z","snapshot_observed_at":"2026-08-07T00:43:03.992583Z","submitted_at":"2025-06-14T18:19:05Z","title":"A Comprehensive Survey of Deep Research: Systems, Methodologies, and Applications","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T00:48:12.357777Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2506.12594"},"observation_digest":"sha256:e9cdff94a4ec5b97b44ca0aa7e22b30f9282306eb03fccbdc6e6b4c19ae06604","observation_id":"3fa6d92e-7307-45d5-99eb-f64291649600","resolution":{"observed_at":"2026-08-07T00:48:12.357777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-06T23:59:46.134886Z","title":"Why do multi-agent llm systems fail?arXiv preprint arXiv:2503.13657,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.15451","last_updated":"2025-06-18T13:24:04Z","snapshot_observed_at":"2026-08-06T23:53:19.361837Z","submitted_at":"2025-06-18T13:24:04Z","title":"AgentGroupChat-V2: Divide-and-Conquer Is What LLM-Based Multi-Agent System Need","version":1},"reference_index":1994,"source":"pdf_text","source_observed_at":"2026-08-06T23:59:46.134886Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2506.15451"},"observation_digest":"sha256:8799db733d80bcbdb0114cdf6cfac45faf6545f5eaace41399d1213f00721229","observation_id":"9d643e24-23f0-4a49-a6d2-bd19713a361e","resolution":{"observed_at":"2026-08-06T23:59:46.134886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-06T23:43:12.742792Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.16628","last_updated":"2025-06-19T21:55:33Z","snapshot_observed_at":"2026-08-06T23:35:57.004261Z","submitted_at":"2025-06-19T21:55:33Z","title":"Initial Investigation of LLM-Assisted Development of Rule-Based Clinical NLP System","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:43:12.742792Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2506.16628"},"observation_digest":"sha256:e33f6df7700ff63a6086cacf21e6fa22d81049f9f86be7486d64322fe2b4728c","observation_id":"948c32ed-b38e-48e7-a8a5-a4f0d22a5f33","resolution":{"observed_at":"2026-08-06T23:43:12.742792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-06T23:35:47.565189Z","title":"Why do multi- agent llm systems fail?arXiv preprint arXiv:2503.13657, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17514","last_updated":"2025-06-20T23:37:17Z","snapshot_observed_at":"2026-08-07T08:30:51.252937Z","submitted_at":"2025-06-20T23:37:17Z","title":"Kaleidoscopic Teaming in Multi Agent Simulations","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:35:47.565189Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2506.17514"},"observation_digest":"sha256:560bad8a27d638f9c39121880bf24ae369e89dff2e557dc808088b0e02f3efeb","observation_id":"be3b2584-87c4-4ca6-bc69-a67f78875611","resolution":{"observed_at":"2026-08-06T23:35:47.565189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-06T23:00:15.100311Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20112","last_updated":"2025-06-25T04:02:29Z","snapshot_observed_at":"2026-08-06T22:54:07.289904Z","submitted_at":"2025-06-25T04:02:29Z","title":"A Multi-Pass Large Language Model Framework for Precise and Efficient Radiology Report Error Detection","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T23:00:15.100311Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2506.20112"},"observation_digest":"sha256:5d872cfb1a85c435737a64f7ea6da6b774f0a745766d608443fc4ac3a916bbac","observation_id":"182dd31f-5b6b-4f5d-91ef-a376291f312a","resolution":{"observed_at":"2026-08-06T23:00:15.100311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-06T22:47:23.099775Z","title":"Michael Duan, Anshuman Suri, Niloofar Mireshghallah, Sewon Min, Weijia Shi, Luke Zettlemoyer, Yulia Tsvetkov, Yejin Choi, David Evans, and Hannaneh Hajishirzi","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.20737","last_updated":"2025-06-25T18:04:25Z","snapshot_observed_at":"2026-08-07T03:50:41.307841Z","submitted_at":"2025-06-25T18:04:25Z","title":"MAGPIE: A dataset for Multi-AGent contextual PrIvacy Evaluation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T22:47:23.099775Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2506.20737"},"observation_digest":"sha256:14f8469bbdf33483f8f1d55dcba8726e2fefcc8cde7d0570e184a1c9d8ccbf4b","observation_id":"31c9dfb6-da32-4c76-97b0-377d69240076","resolution":{"observed_at":"2026-08-06T22:47:23.099775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-06T16:59:39.665437Z","title":"Pan, Shuyi Yang, Lakshya A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11988","last_updated":"2025-07-17T03:34:27Z","snapshot_observed_at":"2026-08-07T06:45:58.540447Z","submitted_at":"2025-07-16T07:38:28Z","title":"Aime: Towards Fully-Autonomous Multi-Agent Framework","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T16:59:39.665437Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2507.11988"},"observation_digest":"sha256:a4ca49d00734e2cc9dbb9e70b6e0c1c2dcbe31e844b483e85dd12c490d015e84","observation_id":"bcc1662b-5e3c-4f36-b36b-652713468c2c","resolution":{"observed_at":"2026-08-06T16:59:39.665437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-06T15:39:56.793374Z","title":"Pan, Shuyi Yang, Lakshya A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.15296","last_updated":"2025-07-21T06:55:37Z","snapshot_observed_at":"2026-08-06T15:33:04.507427Z","submitted_at":"2025-07-21T06:55:37Z","title":"Butterfly Effects in Toolchains: A Comprehensive Analysis of Failed Parameter Filling in LLM Tool-Agent Systems","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T15:39:56.793374Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2507.15296"},"observation_digest":"sha256:bd42fe1d2abb1cbaa7dc05036ca2323dc1cf8b288418af548c7371383ead11a9","observation_id":"fa08179f-f065-4f53-8e6c-2b63b4fa8970","resolution":{"observed_at":"2026-08-06T15:39:56.793374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-06T15:33:14.226186Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15559","last_updated":"2025-07-21T12:39:08Z","snapshot_observed_at":"2026-08-07T05:22:01.941947Z","submitted_at":"2025-07-21T12:39:08Z","title":"FlowForge: Guiding the Creation of Multi-agent Workflows with Design Space Visualization as a Thinking Scaffold","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T15:33:14.226186Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2507.15559"},"observation_digest":"sha256:4a27798f43084ab1cf5e0c4cdd4dd88e96cf2bce68216896c160bf88b2b88fd2","observation_id":"e8afbcae-ec67-4b03-a0ef-2631e4b9e256","resolution":{"observed_at":"2026-08-06T15:33:14.226186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-06T15:30:37.747896Z","title":"Pan, Shuyi Yang, Lakshya A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.15759","last_updated":"2025-07-21T16:15:18Z","snapshot_observed_at":"2026-08-06T15:21:50.982390Z","submitted_at":"2025-07-21T16:15:18Z","title":"Interaction as Intelligence: Deep Research With Human-AI Partnership","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T15:30:37.747896Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2507.15759"},"observation_digest":"sha256:ec168339b1b3764685eaee61294f4b5965b815db0f7bac9843141e5abde96add","observation_id":"01792ce6-a308-4bdd-8adf-a405881fbde2","resolution":{"observed_at":"2026-08-06T15:30:37.747896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2507.21035","last_updated":"2026-05-17T21:43:43Z","snapshot_observed_at":"2026-07-06T22:04:01.721229Z","submitted_at":"2025-07-28T17:55:08Z","title":"GenoMAS: A Multi-Agent Framework for Scientific Discovery via Code-Driven Gene Expression Analysis","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-22T00:37:11.945418Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2507.21035"},"observation_digest":"sha256:2fead68efe4def68b9bbd43a0cda9ea9ad16d2c5177f8252e32e5af31fc79d2b","observation_id":"f6eec7f7-0f70-4592-9f23-170733eb73d1","resolution":{"observed_at":"2026-05-22T00:40:51.106283Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-06T05:52:41.959776Z","title":"Why do multi-agent llm systems fail?","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.01186","last_updated":"2025-08-02T04:15:30Z","snapshot_observed_at":"2026-08-07T07:31:52.462342Z","submitted_at":"2025-08-02T04:15:30Z","title":"A Survey on Agent Workflow -- Status and Future","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T05:52:41.959776Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2508.01186"},"observation_digest":"sha256:5ce68034d756179557e603f750472093106b534bc0e98e4cdc3bdfb22a78cd36","observation_id":"ad1845d6-d450-4b90-a854-b5fa0ffb049e","resolution":{"observed_at":"2026-08-06T05:52:41.959776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T14:49:00.657410Z","title":"Aili Chen, Xuyang Ge, Ziquan Fu, Yanghua Xiao, and Jiangjie Chen","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.20931","last_updated":"2025-09-01T18:05:06Z","snapshot_observed_at":"2026-08-06T12:07:20.093124Z","submitted_at":"2025-08-28T15:57:33Z","title":"How Can Input Reformulation Improve Tool Usage Accuracy in a Complex Dynamic Environment? A Study on $\\tau$-bench","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T14:49:00.657410Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2508.20931"},"observation_digest":"sha256:5063dfd1d40370cee2ef7dda714eb82775cd09af1dc305d87dea787144a7cd99","observation_id":"47d17b23-1e8e-4061-be06-f01b691f33c6","resolution":{"observed_at":"2026-08-05T14:49:00.657410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T12:32:26.108940Z","title":"Why do multi-agent LLM systems fail?","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.01494","last_updated":"2026-06-05T04:25:26Z","snapshot_observed_at":"2026-08-07T00:50:17.512250Z","submitted_at":"2025-09-01T14:13:34Z","title":"SWR-Bench: Assessing LLM Performance in Real-World Code Review Comment Generation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T12:32:26.108940Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2509.01494"},"observation_digest":"sha256:35badccb86e69c4ffcf0ed97a7da1475a9bd1534037897da4c1a39beac5e1e8c","observation_id":"bcf41024-2b76-4a90-a616-5ee54e0c683d","resolution":{"observed_at":"2026-08-05T12:32:26.108940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T11:30:02.202587Z","title":"Pan, Shuyi Yang, Lakshya A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02751","last_updated":"2025-09-02T18:59:15Z","snapshot_observed_at":"2026-08-05T11:30:01.655498Z","submitted_at":"2025-09-02T18:59:15Z","title":"Deep Research is the New Analytics System: Towards Building the Runtime for AI-Driven Analytics","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T11:30:02.202587Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2509.02751"},"observation_digest":"sha256:c660a3bbbd447508e836f29cfa924402fe8545e1e8222af9003f038f32511008","observation_id":"a1412a14-fc83-4d69-bc19-623e9459500e","resolution":{"observed_at":"2026-08-05T11:30:02.202587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-04T14:42:32.422233Z","title":"Why do multi-agent llm systems fail? arXiv preprint arXiv:2503.13657, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.24088","last_updated":"2026-06-08T21:46:49Z","snapshot_observed_at":"2026-08-07T00:06:07.043188Z","submitted_at":"2025-09-28T21:47:20Z","title":"CORRECT: COndensed eRror RECognition via knowledge Transfer in multi-agent systems","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T14:42:32.422233Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2509.24088"},"observation_digest":"sha256:be66518b4ce79548c51e0a1cbbf10e38222aae6229f98dff4ad295043a339b8c","observation_id":"0d0f6eb2-7bc6-4f09-b474-55ac03795e6c","resolution":{"observed_at":"2026-08-04T14:42:32.422233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2510.07517","last_updated":"2026-04-09T17:03:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-08T20:29:46Z","title":"When Identity Skews Debate: Anonymization for Bias-Reduced Multi-Agent Reasoning","version":5},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-18T08:50:53.486588Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2510.07517"},"observation_digest":"sha256:f732b5aec8e97d0701c5774fc9f20a600d2fcb1f69114701a468e99536bde436","observation_id":"781797b3-0d32-4f5b-bc1a-03f158563cb0","resolution":{"observed_at":"2026-05-18T08:51:08.519681Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-04T10:36:36.637742Z","title":"Why do multi-agent llm systems fail?arXiv preprint arXiv:2503.13657, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.09801","last_updated":"2026-06-09T14:05:10Z","snapshot_observed_at":"2026-08-07T09:24:40.875565Z","submitted_at":"2025-10-10T19:04:28Z","title":"How can we assess human-agent interactions? Case studies in software agent design","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T10:36:36.637742Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2510.09801"},"observation_digest":"sha256:4dc6dc1146ee1998f025c15ab49ae7f95902cb5700cbd2e26a8efcb6e28b1ffc","observation_id":"f1d07e35-cbd4-426e-aa73-e21ffeee458b","resolution":{"observed_at":"2026-08-04T10:36:36.637742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-04T10:23:41.825975Z","title":"Why do multi-agent llm systems fail?arXiv preprint arXiv:2503.13657, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.10185","last_updated":"2026-05-27T14:30:07Z","snapshot_observed_at":"2026-08-04T10:23:37.469136Z","submitted_at":"2025-10-11T11:48:57Z","title":"Auditing medical multi-agent AI reveals risks of false consensus","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T10:23:41.825975Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2510.10185"},"observation_digest":"sha256:78178a2e9adedcbacf195b71765b7fa323885c2c1c686744a9081cd0b1d2ccd4","observation_id":"282b87a9-54d6-4635-b57d-a74281fbc048","resolution":{"observed_at":"2026-08-04T10:23:41.825975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2510.23883","last_updated":"2026-04-03T16:27:34Z","snapshot_observed_at":"2026-08-02T13:42:34.526072Z","submitted_at":"2025-10-27T21:48:11Z","title":"Agentic AI Security: Threats, Defenses, Evaluation, and Open Challenges","version":3},"reference_index":134,"source":"pdf_text","source_observed_at":"2026-05-18T03:42:10.703369Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2510.23883"},"observation_digest":"sha256:2f2d0e0b258e34bf04a474b0244735ecc6d6a12762eb5ff036a5c62c01da26eb","observation_id":"01605d73-519a-46dd-84aa-334d78114c40","resolution":{"observed_at":"2026-05-18T03:42:22.253106Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-03T20:17:48.232736Z","title":"Cemri, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.20639","last_updated":"2026-08-03T15:58:02Z","snapshot_observed_at":"2026-08-06T23:37:32.107617Z","submitted_at":"2025-11-25T18:56:57Z","title":"Latent Collaboration in Multi-Agent Systems","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-03T20:17:48.232736Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2511.20639"},"observation_digest":"sha256:9ccc1f579eb4c0949a9470de221c419dd53f0555f91b1690248ced119d01634b","observation_id":"01ea5f60-2550-4346-aff9-92343be391d9","resolution":{"observed_at":"2026-08-03T20:17:48.232736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-04T06:52:30.129143Z","title":"Cemri, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.20639","last_updated":"2026-08-03T15:58:02Z","snapshot_observed_at":"2026-08-06T23:37:32.107617Z","submitted_at":"2025-11-25T18:56:57Z","title":"Latent Collaboration in Multi-Agent Systems","version":4},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T06:52:30.129143Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2511.20639"},"observation_digest":"sha256:59e679d52b3c795d9ca26aec74f3d272df10192cdc172fceab2343b54f8e1a17","observation_id":"df95e243-8a70-4d65-8f37-2a92410713ca","resolution":{"observed_at":"2026-08-04T06:52:30.129143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2512.02393","last_updated":"2026-04-10T19:52:09Z","snapshot_observed_at":"2026-07-06T22:37:31.360740Z","submitted_at":"2025-12-02T04:12:29Z","title":"Process-Centric Analysis of Agentic Software Systems","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-17T03:14:15.095330Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2512.02393"},"observation_digest":"sha256:233e63cfe8db0dcbb65db3322ffb96942ca1252aa3f66e0b69c459d3b5633b57","observation_id":"c4f8126a-25b0-4136-8081-6c1db6ce9c02","resolution":{"observed_at":"2026-05-17T03:18:57.293757Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2512.05929","last_updated":"2026-06-29T18:18:24Z","snapshot_observed_at":"2026-08-03T18:19:06.255338Z","submitted_at":"2025-12-05T18:12:21Z","title":"LLM Harms: A Taxonomy and Discussion","version":2},"reference_index":250,"source":"pdf_text","source_observed_at":"2026-05-17T00:29:07.951709Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2512.05929"},"observation_digest":"sha256:e3d91ce3d7373a57e7ce2063f88088e833f35ecefbf42e18d8e08a374b151ec3","observation_id":"a05e70ab-67b2-46be-a306-ca8bbddd36ea","resolution":{"observed_at":"2026-05-17T00:31:24.836371Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-03T18:19:33.589393Z","title":"Why Do Multi-Agent LLM Systems Fail?,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.05929","last_updated":"2026-06-29T18:18:24Z","snapshot_observed_at":"2026-08-03T18:19:06.255338Z","submitted_at":"2025-12-05T18:12:21Z","title":"LLM Harms: A Taxonomy and Discussion","version":4},"reference_index":250,"source":"pdf_text","source_observed_at":"2026-08-03T18:19:33.589393Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2512.05929"},"observation_digest":"sha256:ec33cc8c2e8e9a26b065a189bc069c55bc2515c6bb93525193eaaf3dce9a6851","observation_id":"429ac015-9bbe-4dea-9f2a-afa89f80cca8","resolution":{"observed_at":"2026-08-03T18:19:33.589393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-03T17:28:16.011981Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.09543","last_updated":"2025-12-11T11:33:34Z","snapshot_observed_at":"2026-08-05T18:35:30.357011Z","submitted_at":"2025-12-10T11:28:48Z","title":"SWEnergy: An Empirical Study on Energy Efficiency in Agentic Issue Resolution Frameworks with SLMs","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T17:28:16.011981Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2512.09543"},"observation_digest":"sha256:002ee57137b43b4f3e539180e5f3bacc641dd674dcdc2eac82ad25fbd1b0d72c","observation_id":"4fe0bdd6-279e-4cf5-8692-8e824bd271c3","resolution":{"observed_at":"2026-08-03T17:28:16.011981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-03T15:10:13.595342Z","title":"Pan, Shuyi Yang, Lakshya A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.18020","last_updated":"2025-12-19T19:24:56Z","snapshot_observed_at":"2026-08-05T16:53:40.020414Z","submitted_at":"2025-12-19T19:24:56Z","title":"Specification and Detection of LLM Code Smells","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T15:10:13.595342Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2512.18020"},"observation_digest":"sha256:a1525836a67a7394087195936286c3fd610659949b2134efe6232e48355db71c","observation_id":"5c6de89c-c8ab-4207-9a86-6de045c0fc92","resolution":{"observed_at":"2026-08-03T15:10:13.595342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-03T11:01:43.609177Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.07978","last_updated":"2026-07-13T12:55:23Z","snapshot_observed_at":"2026-08-03T11:01:42.993651Z","submitted_at":"2026-01-12T20:20:35Z","title":"Cost and Accuracy of Long-Term Memory in Distributed Multi-Agent Systems Based on Large Language Models","version":4},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T11:01:43.609177Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2601.07978"},"observation_digest":"sha256:6005b0ada33816652fd94286e20a2282cea90cee483ddeef40ee102d704c3a17","observation_id":"61dc81f6-4ea7-4dc4-a61c-10f3c4b96aa5","resolution":{"observed_at":"2026-08-03T11:01:43.609177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2601.15232","last_updated":"2026-04-25T00:03:45Z","snapshot_observed_at":"2026-07-06T22:42:36.961014Z","submitted_at":"2026-01-21T18:13:10Z","title":"When Agents Fail: A Comprehensive Study of Bugs in LLM Agents with Automated Labeling","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T11:54:53.273386Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2601.15232"},"observation_digest":"sha256:fa084ee6a15797233011223e7f36a49df91bb139223fd5876b286235f162de0b","observation_id":"40624c13-3963-4e1d-a7ee-736647bb0c6e","resolution":{"observed_at":"2026-05-16T11:57:50.116180Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2601.21972","last_updated":"2026-05-26T15:41:11Z","snapshot_observed_at":"2026-08-03T06:46:35.623443Z","submitted_at":"2026-01-29T16:50:30Z","title":"Learning Decentralized LLM Collaboration with Multi-Agent Actor Critic","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T09:47:47.051969Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2601.21972"},"observation_digest":"sha256:08d32ca974651894eca0922fe850b261152f4e6e7865dbb2514b660e1b703241","observation_id":"8b432749-dbb5-4730-ae95-7d80ae4644ad","resolution":{"observed_at":"2026-05-16T09:50:49.392902Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-03T06:46:38.444941Z","title":"Z., Yang, S., Agrawal, L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.21972","last_updated":"2026-05-26T15:41:11Z","snapshot_observed_at":"2026-08-03T06:46:35.623443Z","submitted_at":"2026-01-29T16:50:30Z","title":"Learning Decentralized LLM Collaboration with Multi-Agent Actor Critic","version":5},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T06:46:38.444941Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2601.21972"},"observation_digest":"sha256:4461f91a3869f4aa8fd4fcd4c3c1ff32a7285447bf457b0ec683c738ddf55589","observation_id":"33268900-46fb-47d3-b604-333e62fdf3e1","resolution":{"observed_at":"2026-08-03T06:46:38.444941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-03T06:04:50.491839Z","title":"Z., Yang, S., Agrawal, L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.00471","last_updated":"2026-06-05T06:11:46Z","snapshot_observed_at":"2026-08-03T06:04:48.314183Z","submitted_at":"2026-01-31T02:49:10Z","title":"Dual Latent Memory for Visual Multi-agent System","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T06:04:50.491839Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2602.00471"},"observation_digest":"sha256:83cb28b305e5659a4b7c381d9c48c40c39d7c70cddb8764c4e1d70a769f0a604","observation_id":"d817c6eb-0b10-4fd9-a738-2d332b064753","resolution":{"observed_at":"2026-08-03T06:04:50.491839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-02T23:18:01.150313Z","title":"Why do multi-agent llm systems fail?arXiv preprint arXiv:2503.13657, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14345","last_updated":"2026-06-20T15:35:41Z","snapshot_observed_at":"2026-08-04T23:17:09.418561Z","submitted_at":"2026-02-15T23:25:14Z","title":"AXE: Grey-Box Exploitability Confirmation for Localized Vulnerability Reports","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T23:18:01.150313Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2602.14345"},"observation_digest":"sha256:2864a4a8a093551d943ec845fa19c69feed2e080d533ebcb381317f5a577e319","observation_id":"0f84887d-09ba-408e-a202-20e5180dcda6","resolution":{"observed_at":"2026-08-02T23:18:01.150313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-02T22:58:04.493783Z","title":"Why do multi-agent llm systems fail? arXiv preprint arXiv:2503.13657, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.15382","last_updated":"2026-05-28T08:46:27Z","snapshot_observed_at":"2026-08-03T23:19:36.572742Z","submitted_at":"2026-02-17T06:31:53Z","title":"The Vision Wormhole: Latent-Space Communication in Heterogeneous Multi-Agent Systems","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-02T22:58:04.493783Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2602.15382"},"observation_digest":"sha256:f161745247e64cded353f33e3cf42161ab714b0e292fe28f13017cb4f70beb2b","observation_id":"59e7c1cf-cd03-4b8d-9abf-c854dc97bb1c","resolution":{"observed_at":"2026-08-02T22:58:04.493783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2602.16708","last_updated":"2026-05-08T15:45:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-18T18:57:12Z","title":"Formal Policy Enforcement for Real-World Agentic Systems","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T21:08:06.259177Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2602.16708"},"observation_digest":"sha256:d92e8f139db1224d508f55828d1db72be047a19b59a976ba21a5a993ed306833","observation_id":"f9ea31c3-60f0-4ae2-b87c-20f534d914c8","resolution":{"observed_at":"2026-05-15T21:10:18.572990Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-02T21:59:14.368894Z","title":"Why do multi-agent llm systems fail?arXiv preprint arXiv:2503.13657,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.18640","last_updated":"2026-05-24T20:50:17Z","snapshot_observed_at":"2026-08-02T21:59:13.405870Z","submitted_at":"2026-02-20T22:24:01Z","title":"Decoding ML Decision: An Agentic Reasoning Framework for Large-Scale Ranking System","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-02T21:59:14.368894Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2602.18640"},"observation_digest":"sha256:96267a12d2722a6ed8ec250ef73905af989e5fabe73cf3d24001c75625872f5a","observation_id":"9188d3c5-a3d3-4b2f-829d-c58554793e8a","resolution":{"observed_at":"2026-08-02T21:59:14.368894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-02T19:59:45.979052Z","title":"Why do multi-agent llm systems fail?arXiv preprint arXiv:2503.13657,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.00309","last_updated":"2026-05-27T02:58:47Z","snapshot_observed_at":"2026-08-02T19:59:45.309978Z","submitted_at":"2026-02-27T20:59:37Z","title":"DIG to Heal: Scaling General-purpose Agent Collaboration via Explainable Dynamic Decision Paths","version":2},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-02T19:59:45.979052Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2603.00309"},"observation_digest":"sha256:2c505499aa84c71dbc87dcd85b557df4faa0705e2b2e3760313311dfb4a318e2","observation_id":"9f120868-6378-437c-b9b1-e73b5ae20db6","resolution":{"observed_at":"2026-08-02T19:59:45.979052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2603.06847","last_updated":"2026-05-07T16:46:46Z","snapshot_observed_at":"2026-08-06T06:57:11.630348Z","submitted_at":"2026-03-06T20:12:29Z","title":"Characterizing Faults in Agentic AI: A Taxonomy of Types, Symptoms, and Root Causes","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T14:42:40.925632Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2603.06847"},"observation_digest":"sha256:30c2fe7024da07827d1d40ba66114b17db9dd87380965257cdd84e9362dca6e6","observation_id":"4e2a098d-a09f-41a7-91fa-d72b408e99f3","resolution":{"observed_at":"2026-05-15T14:46:08.250157Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2603.09002","last_updated":"2026-04-26T14:13:48Z","snapshot_observed_at":"2026-07-06T22:48:26.306802Z","submitted_at":"2026-03-09T22:46:27Z","title":"Security Considerations for Multi-agent Systems","version":2},"reference_index":199,"source":"pdf_text","source_observed_at":"2026-05-15T14:12:14.160789Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2603.09002"},"observation_digest":"sha256:679385575c5c7fa94828fb0c58731135099d88d99fc41a7655bd64abffcc7922","observation_id":"5349091b-0b94-41f2-b1e8-3ba8731965b7","resolution":{"observed_at":"2026-05-15T14:15:55.849512Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-07-14T22:25:15.261445Z","title":"Why do multi-agent LLM systems fail?arXiv preprint arXiv:2503.13657, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.12235","last_updated":"2026-06-30T10:27:28Z","snapshot_observed_at":"2026-08-06T20:38:08.147890Z","submitted_at":"2026-03-12T17:53:33Z","title":"Transition from Statistical to Hardware-Limited Scaling in Photonic Quantum State Reconstruction","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-14T22:25:15.261445Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2603.12235"},"observation_digest":"sha256:0f928c4f1ae54cc844cf8c2c17a70f24dd53fbb5886b6fb9ffc66012885546d3","observation_id":"b688df51-36e3-46cd-b6b7-5aca1c125038","resolution":{"observed_at":"2026-07-14T22:25:15.261445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2603.20380","last_updated":"2026-05-15T21:59:54Z","snapshot_observed_at":"2026-08-02T14:54:38.320669Z","submitted_at":"2026-03-20T18:00:09Z","title":"Herding CATs: ALARA for Agent Harness Engineering in Portable Composable Multi-Agent Teams","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-21T11:12:46.626382Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2603.20380"},"observation_digest":"sha256:c6217e736a7a1601e84eb6cebee64540068fc632ac07d3d6fc7a6f204d90d49e","observation_id":"222abec9-9f50-4afe-bb6d-3f8fb3256dea","resolution":{"observed_at":"2026-05-21T11:14:08.435357Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-07-13T20:49:09.477849Z","title":"Why do multi-agent llm systems fail?arXiv preprint arXiv:2503.13657,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.21489","last_updated":"2026-07-08T16:30:55Z","snapshot_observed_at":"2026-08-03T00:37:21.202769Z","submitted_at":"2026-03-23T02:26:35Z","title":"Effective Strategies for Asynchronous Software Engineering Agents","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T20:49:09.477849Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2603.21489"},"observation_digest":"sha256:d60e5ebb4badb106a003d453e2dfb5fbae2094f5d21b626fe8bcfc87d59f47ba","observation_id":"546e9adc-e5fc-40dc-8d47-b239e757bcb7","resolution":{"observed_at":"2026-07-13T20:49:09.477849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2603.27771","last_updated":"2026-04-04T07:45:49Z","snapshot_observed_at":"2026-07-06T22:51:00.579062Z","submitted_at":"2026-03-29T17:10:28Z","title":"Emergent Social Intelligence Risks in Generative Multi-Agent Systems","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-14T21:45:04.625084Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2603.27771"},"observation_digest":"sha256:b2e891dc572263101bc66e156cf9d242bfca9d284531555f0c22eca71dc4457b","observation_id":"baacabd3-e3f1-4a9d-a53e-6593abbfc864","resolution":{"observed_at":"2026-05-14T21:48:00.820268Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2604.02674","last_updated":"2026-04-03T03:08:07Z","snapshot_observed_at":"2026-07-06T22:52:02.162758Z","submitted_at":"2026-04-03T03:08:07Z","title":"Do Agent Societies Develop Intellectual Elites? The Hidden Power Laws of Collective Cognition in LLM Multi-Agent Systems","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T19:11:52.387623Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2604.02674"},"observation_digest":"sha256:455309a210ff32deb9002ae0aff4a13af4ecb1e3912f99328638d36871b21180","observation_id":"b166fdee-bb8c-4f49-95b5-eb7302c73baf","resolution":{"observed_at":"2026-05-13T19:13:09.700478Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2604.02770","last_updated":"2026-04-03T06:28:59Z","snapshot_observed_at":"2026-07-06T22:52:06.460027Z","submitted_at":"2026-04-03T06:28:59Z","title":"Improving Role Consistency in Multi-Agent Collaboration via Quantitative Role Clarity","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T20:12:35.823189Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2604.02770"},"observation_digest":"sha256:81c7c5bb8d0630135a5e59190fe67cf738f70404c948370fe608994d950851e5","observation_id":"6c24b429-62d4-44f5-96e7-30e0f453318d","resolution":{"observed_at":"2026-05-13T20:13:12.977004Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2604.05150","last_updated":"2026-04-06T20:25:20Z","snapshot_observed_at":"2026-07-06T22:53:55.926521Z","submitted_at":"2026-04-06T20:25:20Z","title":"Compiled AI: Deterministic Code Generation for LLM-Based Workflow Automation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T18:57:34.386632Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2604.05150"},"observation_digest":"sha256:ff308d115f25051b8f4b86867ca3b0963a921428fedd21260f43991fd7defbd8","observation_id":"78fcf2a1-d005-4e23-838b-1426689ea456","resolution":{"observed_at":"2026-05-12T05:42:59.242121Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2604.05719","last_updated":"2026-04-07T11:19:16Z","snapshot_observed_at":"2026-08-02T08:12:46.257370Z","submitted_at":"2026-04-07T11:19:16Z","title":"Hackers or Hallucinators? A Comprehensive Analysis of LLM-Based Automated Penetration Testing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T18:52:57.225878Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2604.05719"},"observation_digest":"sha256:0652693ca2ebc9820797d4c1494ca6dba556c7a402962194f92076fcabfcb644","observation_id":"b3f955ad-ecab-4226-bf03-73196752c8a2","resolution":{"observed_at":"2026-05-12T05:42:59.242121Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2604.06392","last_updated":"2026-04-07T19:22:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-07T19:22:20Z","title":"Qualixar OS: A Universal Operating System for AI Agent Orchestration","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T18:44:25.389675Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2604.06392"},"observation_digest":"sha256:7c6f574cd54c0cd1bd27a0c008fb291ed56a81e60b765b640d00dd49cb6d6f31","observation_id":"1dd9a4a2-d9e0-4100-9ecb-f4cbf1910467","resolution":{"observed_at":"2026-05-12T05:42:59.242121Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2604.06452","last_updated":"2026-04-07T20:47:40Z","snapshot_observed_at":"2026-08-05T13:22:07.566013Z","submitted_at":"2026-04-07T20:47:40Z","title":"Learning to Interrupt in Language-based Multi-agent Communication","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-10T19:08:45.818851Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2604.06452"},"observation_digest":"sha256:8e42a02dbfbf1d9571aac815a304fb9b6eb28e895562aaaa6f93a6227abaab47","observation_id":"36eb84ed-8978-4293-a709-4879cc315d1e","resolution":{"observed_at":"2026-05-12T05:42:59.242121Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2604.09056","last_updated":"2026-04-10T07:29:39Z","snapshot_observed_at":"2026-07-06T22:58:04.106299Z","submitted_at":"2026-04-10T07:29:39Z","title":"Conversations Risk Detection LLMs in Financial Agents via Multi-Stage Generative Rollout","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T17:54:41.534985Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2604.09056"},"observation_digest":"sha256:9dd3d93ab1a4a28e181258ff3ad27c868fb8c56ec02d677312332cb907c855ed","observation_id":"5c1c7a64-cc64-4f1a-b321-01e83e469adf","resolution":{"observed_at":"2026-05-12T05:42:59.242121Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2604.14228","last_updated":"2026-07-02T17:12:13Z","snapshot_observed_at":"2026-07-12T21:00:43.195941Z","submitted_at":"2026-04-14T17:59:37Z","title":"Dive into Claude Code: The Design Space of Today's and Future AI Agent Systems","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T14:30:30.311285Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2604.14228"},"observation_digest":"sha256:2fd4c8cceb77d8889c6a9e5db7f4a653eee86e9bb6da4609b0824ec380acea99","observation_id":"e5688f27-c580-42c4-832f-712844961397","resolution":{"observed_at":"2026-05-12T05:42:59.242121Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2604.15236","last_updated":"2026-04-16T17:11:28Z","snapshot_observed_at":"2026-07-06T23:02:49.302337Z","submitted_at":"2026-04-16T17:11:28Z","title":"Agentic Microphysics: A Manifesto for Generative AI Safety","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T09:41:35.898661Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2604.15236"},"observation_digest":"sha256:0f87b0796c7153afa4271d762355ef26fcbc602c7fe32d8b24bb49768aef93f8","observation_id":"f737e688-7ada-4649-94d2-a5f437eb67c3","resolution":{"observed_at":"2026-05-12T05:42:59.242121Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2604.16339","last_updated":"2026-03-13T14:55:38Z","snapshot_observed_at":"2026-07-06T23:03:39.351412Z","submitted_at":"2026-03-13T14:55:38Z","title":"Semantic Consensus: Process-Aware Conflict Detection and Resolution for Enterprise Multi-Agent LLM Systems","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T12:04:08.305246Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2604.16339"},"observation_digest":"sha256:7d63348c29351e365128dbc77369c6e4e8d1ac2d124ddd50ee19ad24bb93cca6","observation_id":"aa3ed4e3-9d83-4fab-acbf-c8319e89d1bc","resolution":{"observed_at":"2026-05-15T12:05:33.379668Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2604.17761","last_updated":"2026-04-20T03:24:11Z","snapshot_observed_at":"2026-08-04T06:40:12.598546Z","submitted_at":"2026-04-20T03:24:11Z","title":"Contrastive Attribution in the Wild: An Interpretability Analysis of LLM Failures on Realistic Benchmarks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T05:12:31.218055Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2604.17761"},"observation_digest":"sha256:85ccb252eb6f4fd420d9b2297191751299ab4834029588471293d307a006fe9b","observation_id":"92aee467-b906-475d-8467-6cf880f3598c","resolution":{"observed_at":"2026-05-12T05:42:59.242121Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2604.17817","last_updated":"2026-04-20T05:15:14Z","snapshot_observed_at":"2026-07-06T23:04:50.935335Z","submitted_at":"2026-04-20T05:15:14Z","title":"Do LLMs Need to See Everything? A Benchmark and Study of Failures in LLM-driven Smartphone Automation using Screentext vs. Screenshots","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T04:42:21.843629Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2604.17817"},"observation_digest":"sha256:ef2180bf2c40b179f2d44726e89850b3f46288ac8f173cc8d5998a5a47585df2","observation_id":"74ded1c2-3233-481e-9fb0-37249382987b","resolution":{"observed_at":"2026-05-12T05:42:59.242121Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2604.19540","last_updated":"2026-04-21T15:00:25Z","snapshot_observed_at":"2026-07-31T21:03:59.427184Z","submitted_at":"2026-04-21T15:00:25Z","title":"Mesh Memory Protocol: Semantic Infrastructure for Multi-Agent LLM Systems","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T00:59:44.763364Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2604.19540"},"observation_digest":"sha256:b5f90b7d8afd361399a3c01f60a958ddde9d01be0d51a1fa20990912a688f5a0","observation_id":"7206b364-ce66-4922-8a6f-d168a81d08de","resolution":{"observed_at":"2026-05-12T05:42:59.242121Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2604.19827","last_updated":"2026-04-20T15:09:55Z","snapshot_observed_at":"2026-07-06T23:06:26.596990Z","submitted_at":"2026-04-20T15:09:55Z","title":"More Is Different: Toward a Theory of Emergence in AI-Native Software Ecosystems","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T04:15:59.663339Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2604.19827"},"observation_digest":"sha256:b7a15bd6717f6f4384a6802af4ed0a3a05092863434da421f86af860f602d3d3","observation_id":"200b1a41-4106-42da-95cc-966381ca9590","resolution":{"observed_at":"2026-05-12T05:42:59.242121Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2604.21375","last_updated":"2026-04-24T17:01:08Z","snapshot_observed_at":"2026-08-02T05:47:52.335425Z","submitted_at":"2026-04-23T07:42:37Z","title":"VLAA-GUI: Knowing When to Stop, Recover, and Search, A Modular Framework for GUI Automation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-09T22:24:45.045405Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2604.21375"},"observation_digest":"sha256:f72388d1ca605b64cde4ce06e287d5648384191ce45ba4a40c2d8528415a1da4","observation_id":"0129f0d0-8b46-4a47-926f-73f1edce8aa0","resolution":{"observed_at":"2026-05-12T05:42:59.242121Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2604.22136","last_updated":"2026-04-24T00:56:55Z","snapshot_observed_at":"2026-07-06T23:08:37.811548Z","submitted_at":"2026-04-24T00:56:55Z","title":"Sovereign Agentic Loops: Decoupling AI Reasoning from Execution in Real-World Systems","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-08T11:50:57.149878Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2604.22136"},"observation_digest":"sha256:01ac614f48cab934c0929f9868d5779abec5d4c27f3c1708d2fe8a65fac81795","observation_id":"aae665dc-2a9c-4466-938d-e8cff2af0ff2","resolution":{"observed_at":"2026-05-12T05:42:59.242121Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2604.23581","last_updated":"2026-04-26T07:38:47Z","snapshot_observed_at":"2026-07-06T23:09:48.137856Z","submitted_at":"2026-04-26T07:38:47Z","title":"AgentEval: DAG-Structured Step-Level Evaluation for Agentic Workflows with Error Propagation Tracking","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T05:55:39.802529Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2604.23581"},"observation_digest":"sha256:60119ef653b2cd65aa25d8aa642845f1c95a32fe46fb2cf53b04957c80633143","observation_id":"4d8c387a-7794-48a7-a92c-faecf278644a","resolution":{"observed_at":"2026-05-12T05:42:59.242121Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2604.23993","last_updated":"2026-04-27T03:18:00Z","snapshot_observed_at":"2026-08-06T23:24:27.079509Z","submitted_at":"2026-04-27T03:18:00Z","title":"EPM-RL: Reinforcement Learning for On-Premise Product Mapping in E-Commerce","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T03:49:17.063213Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2604.23993"},"observation_digest":"sha256:bbd47ea76bf558ad29b9a131264650b5a7c158647acb775ba834d888c1f12d85","observation_id":"a6f9599d-ef04-40a9-a690-31434d7f5960","resolution":{"observed_at":"2026-05-12T05:42:59.242121Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2604.24579","last_updated":"2026-04-27T15:05:45Z","snapshot_observed_at":"2026-07-06T23:10:33.821313Z","submitted_at":"2026-04-27T15:05:45Z","title":"Measuring the Unmeasurable: Markov Chain Reliability for LLM Agents","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-08T02:52:07.314962Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2604.24579"},"observation_digest":"sha256:71ca46a963afdbd3576e914a826672772a9ca61f5c023d4905e9dbdf1bb62655","observation_id":"da9328ed-8f95-4684-80ad-2c32f6f07462","resolution":{"observed_at":"2026-05-12T05:42:59.242121Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2604.27132","last_updated":"2026-04-29T19:32:58Z","snapshot_observed_at":"2026-07-06T23:12:38.453388Z","submitted_at":"2026-04-29T19:32:58Z","title":"TRUST: A Framework for Decentralized AI Service v.0.1","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-07T08:22:14.239443Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2604.27132"},"observation_digest":"sha256:002c7e0b0bac3e28fc24366011044454b34166b77483460ea7c1b725ef154664","observation_id":"65850ca9-1be9-45eb-b8e8-830fad864ebb","resolution":{"observed_at":"2026-05-12T10:01:28.673240Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2604.27586","last_updated":"2026-04-30T08:39:42Z","snapshot_observed_at":"2026-07-30T12:38:13.045739Z","submitted_at":"2026-04-30T08:39:42Z","title":"Trace-Level Analysis of Information Contamination in Multi-Agent Systems","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-07T09:41:15.185578Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2604.27586"},"observation_digest":"sha256:50e609a916f76e76c7eb1f88db93396448d3b0c411741c1e52172dc0a4d20f5b","observation_id":"a57720f6-7544-4cfa-a3ae-05dd37d8c7d8","resolution":{"observed_at":"2026-05-12T09:41:27.088542Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.03310","last_updated":"2026-05-05T02:56:44Z","snapshot_observed_at":"2026-08-02T05:25:17.389313Z","submitted_at":"2026-05-05T02:56:44Z","title":"Coordination as an Architectural Layer for LLM-Based Multi-Agent Systems","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-09T15:43:19.764483Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.03310"},"observation_digest":"sha256:9a1230edd73186d5ecd72ad08e858ede6250bf20e71fcc159d62d47020ad28f9","observation_id":"9a97d7ad-1d44-4630-81fd-6c59fc4237c3","resolution":{"observed_at":"2026-05-12T05:42:59.242121Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.05701","last_updated":"2026-05-07T05:45:58Z","snapshot_observed_at":"2026-08-06T17:07:50.920537Z","submitted_at":"2026-05-07T05:45:58Z","title":"Inference-Time Budget Control for LLM Search Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T11:51:02.872129Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.05701"},"observation_digest":"sha256:7398229302eb450ce396099a0fc6ef079447902098d7c76636210eb6fe166dfc","observation_id":"e9becf73-6381-4272-9ef1-c8aeb297e7fb","resolution":{"observed_at":"2026-05-12T05:42:59.242121Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.06320","last_updated":"2026-05-07T14:19:17Z","snapshot_observed_at":"2026-07-06T23:18:46.145104Z","submitted_at":"2026-05-07T14:19:17Z","title":"Improving the Efficiency of Language Agent Teams with Adaptive Task Graphs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T03:44:07.323690Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.06320"},"observation_digest":"sha256:c0a4a385f7f9d0aaf9dc5b50a41010fd3a1573ef52b76251982fab39664de78a","observation_id":"5c27ca70-bfd7-46e1-86ee-9c53d18c5602","resolution":{"observed_at":"2026-05-12T05:42:59.242121Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.07069","last_updated":"2026-05-12T03:22:59Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T00:30:02Z","title":"Social Theory Should Be a Structural Prior for Agentic AI: A Formal Framework for Multi-Agent Social Systems","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-11T01:21:15.692441Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.07069"},"observation_digest":"sha256:96baa9ddacde54bcfaada4c3cb907c401436580e9998be2bcda57e76c81d2bc8","observation_id":"760b94f6-a36d-4f36-8edf-27a0f0dbcd09","resolution":{"observed_at":"2026-05-12T05:42:59.242121Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.07069","last_updated":"2026-05-12T03:22:59Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T00:30:02Z","title":"Social Theory Should Be a Structural Prior for Agentic AI: A Formal Framework for Multi-Agent Social Systems","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-12T04:25:03.492449Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.07069"},"observation_digest":"sha256:4c0bc3235c2905040cf8945cfcadec44d79bc4382bfeb1797485053b314d4b74","observation_id":"11f9478c-4312-41f8-a716-42eb95085d82","resolution":{"observed_at":"2026-05-12T06:16:28.802563Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.07069","last_updated":"2026-05-12T03:22:59Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T00:30:02Z","title":"Social Theory Should Be a Structural Prior for Agentic AI: A Formal Framework for Multi-Agent Social Systems","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-13T07:57:44.235469Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.07069"},"observation_digest":"sha256:7a2137e74ba4b1bb945d0d7de672b8933a3dc6c5ad239ecdbc4c8635fe75d706","observation_id":"add8ba5b-0276-46cd-8a3b-a97e8d39739f","resolution":{"observed_at":"2026-05-13T08:02:32.067117Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.07073","last_updated":"2026-05-08T00:48:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-08T00:48:45Z","title":"TeamBench: Evaluating Agent Coordination under Enforced Role Separation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-11T00:55:51.358828Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.07073"},"observation_digest":"sha256:e7a31376385ef1150f4f207e4f11853ba47251fcaaf786d7c558a9a1a0b3eb49","observation_id":"5c5c8c89-6407-4dea-9078-f559d175688f","resolution":{"observed_at":"2026-05-12T05:42:59.242121Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.07773","last_updated":"2026-05-08T14:12:20Z","snapshot_observed_at":"2026-07-06T23:20:06.574823Z","submitted_at":"2026-05-08T14:12:20Z","title":"Is a team only as strong as its weakest link? Quantifying the short-board effect with AI Agents","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-11T02:28:49.522313Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.07773"},"observation_digest":"sha256:dd3f982de324e76e410cb569a8e35352b396719739c3a07b60a556a9d0e0f380","observation_id":"debfbd79-17c6-498d-b075-0c3ff0b44df4","resolution":{"observed_at":"2026-05-12T05:42:59.242121Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.07935","last_updated":"2026-05-08T16:05:31Z","snapshot_observed_at":"2026-08-03T01:09:10.584822Z","submitted_at":"2026-05-08T16:05:31Z","title":"TraceFix: Repairing Agent Coordination Protocols with TLA+ Counterexamples","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-11T03:27:03.589336Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.07935"},"observation_digest":"sha256:b5d3fc4aca4d2d1a3fee34fa5495382e6e6e19ee2fb896b91cd2186dfcccaa10","observation_id":"cafec856-56d2-4bc8-8b4d-161c9af60d7b","resolution":{"observed_at":"2026-05-12T05:42:59.242121Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.08715","last_updated":"2026-05-13T23:06:48Z","snapshot_observed_at":"2026-07-06T23:20:52.521341Z","submitted_at":"2026-05-09T05:55:19Z","title":"AgentForesight: Online Auditing for Early Failure Prediction in Multi-Agent Systems","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-12T01:19:49.062330Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.08715"},"observation_digest":"sha256:ae63b7e0812a06162813c1083ca17e214803e666945337e58188f051f65ab847","observation_id":"72e3c4a6-ce69-493f-80bf-93e91d7ed3e3","resolution":{"observed_at":"2026-05-12T08:06:27.347306Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.08715","last_updated":"2026-05-13T23:06:48Z","snapshot_observed_at":"2026-07-06T23:20:52.521341Z","submitted_at":"2026-05-09T05:55:19Z","title":"AgentForesight: Online Auditing for Early Failure Prediction in Multi-Agent Systems","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T05:24:54.265411Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.08715"},"observation_digest":"sha256:edb4b8e51a9472e4a406dea175a685b8c06995d099fbe762a08d73ee2956c47f","observation_id":"59a4ac8f-eb04-4d2e-85e9-5309776934d7","resolution":{"observed_at":"2026-05-15T05:25:03.756672Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.10286","last_updated":"2026-05-11T09:46:41Z","snapshot_observed_at":"2026-07-06T23:22:18.704329Z","submitted_at":"2026-05-11T09:46:41Z","title":"AgentRx: A Benchmark Study of LLM Agents for Multimodal Clinical Prediction Tasks","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-05-12T05:10:02.941396Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.10286"},"observation_digest":"sha256:ddecf55d8e506a83423443ab58e731e6342eff94abf937fe128d00e6390d8d79","observation_id":"d0d71ce1-715c-4037-815f-5e25acfa5a8f","resolution":{"observed_at":"2026-05-12T05:42:59.242121Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.10913","last_updated":"2026-06-24T17:55:07Z","snapshot_observed_at":"2026-08-02T06:55:55.998448Z","submitted_at":"2026-05-11T17:50:51Z","title":"Shepherd: Enabling Programmable Meta-Agents via Reversible Agentic Execution Traces","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T03:29:33.497561Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.10913"},"observation_digest":"sha256:573a0f37b31e20799fe88fb85dd93ef90007f6088ad2dfa7f101b40f398c8e7a","observation_id":"505f7c51-9684-43a2-b42e-254146b51352","resolution":{"observed_at":"2026-05-12T07:16:31.006348Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.10913","last_updated":"2026-06-24T17:55:07Z","snapshot_observed_at":"2026-08-02T06:55:55.998448Z","submitted_at":"2026-05-11T17:50:51Z","title":"Shepherd: Enabling Programmable Meta-Agents via Reversible Agentic Execution Traces","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T22:24:26.528532Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.10913"},"observation_digest":"sha256:2c7a51b7e684a2650c59914e883cc814d9e41192b1ae2e883d9b08bff754575b","observation_id":"7103ba4f-9464-4d37-82f2-a7a1edf0f6bc","resolution":{"observed_at":"2026-06-30T22:25:06.769897Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.11225","last_updated":"2026-05-11T20:43:20Z","snapshot_observed_at":"2026-08-02T05:32:20.307482Z","submitted_at":"2026-05-11T20:43:20Z","title":"PIVOT: Bridging Planning and Execution in LLM Agents via Trajectory Refinement","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T02:22:04.669760Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.11225"},"observation_digest":"sha256:99c38c9619d0648d69c05cdb6510d915e5fdd9feb5c62c44af31f48222b38234","observation_id":"d75e29fe-489f-4a7d-a440-867245f2a15e","resolution":{"observed_at":"2026-05-13T02:22:06.185933Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.12280","last_updated":"2026-06-19T11:26:47Z","snapshot_observed_at":"2026-07-06T23:23:59.123377Z","submitted_at":"2026-05-12T15:39:04Z","title":"Iterative Audit Convergence in LLM-Managed Multi-Agent Systems: A Case Study in Prompt-Engineering Quality Assurance","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T03:33:19.193036Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.12280"},"observation_digest":"sha256:d2ecf9febeb1954452b313a29c3a992444600552a42c10717234e47f6d6ffead","observation_id":"eaae0ef6-4618-4ad6-8c0e-9cb930facb22","resolution":{"observed_at":"2026-05-13T03:37:11.647491Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.12280","last_updated":"2026-06-19T11:26:47Z","snapshot_observed_at":"2026-07-06T23:23:59.123377Z","submitted_at":"2026-05-12T15:39:04Z","title":"Iterative Audit Convergence in LLM-Managed Multi-Agent Systems: A Case Study in Prompt-Engineering Quality Assurance","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T22:07:05.514346Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.12280"},"observation_digest":"sha256:db9551ebd9e15a6a90b115fa210b04c171fe74cad4eecd5ac10268783e53ad33","observation_id":"7ab4d192-face-462a-a426-aef955467ff8","resolution":{"observed_at":"2026-07-01T14:15:47.463049Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.12925","last_updated":"2026-06-02T15:49:40Z","snapshot_observed_at":"2026-08-06T09:26:59.839613Z","submitted_at":"2026-05-13T03:00:57Z","title":"AgentLens: Revealing The Lucky Pass Problem in SWE-Agent Evaluation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-14T18:51:06.379266Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.12925"},"observation_digest":"sha256:5f2ea324b4ebecb092a07e62e6c2f1682223599855c57ea0d2a25e1de42d7ad9","observation_id":"987a6c14-f684-4906-965b-107bfcbe25e4","resolution":{"observed_at":"2026-05-14T18:52:35.525061Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.12991","last_updated":"2026-05-16T19:42:13Z","snapshot_observed_at":"2026-07-06T23:24:37.915639Z","submitted_at":"2026-05-13T04:45:08Z","title":"Not Just RLHF: Why Alignment Alone Won't Fix Multi-Agent Sycophancy","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-14T20:04:57.638215Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.12991"},"observation_digest":"sha256:2df0708cf9a08cb32746edd8f5b51fb7586a4d4ecf6e7e84ba32752e99078931","observation_id":"cf67d7fb-8240-4b25-b938-4a876ef53df5","resolution":{"observed_at":"2026-05-14T20:07:53.856748Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.12991","last_updated":"2026-05-16T19:42:13Z","snapshot_observed_at":"2026-07-06T23:24:37.915639Z","submitted_at":"2026-05-13T04:45:08Z","title":"Not Just RLHF: Why Alignment Alone Won't Fix Multi-Agent Sycophancy","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T21:30:30.384184Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.12991"},"observation_digest":"sha256:54ab233923c64e805a885d9626b193dc354c73b1535caab108d426d3da269f4a","observation_id":"b6131208-ee67-4dc7-abaf-d56f10cef1d5","resolution":{"observed_at":"2026-05-20T21:33:46.597296Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.13139","last_updated":"2026-05-13T08:05:16Z","snapshot_observed_at":"2026-07-06T23:24:47.309044Z","submitted_at":"2026-05-13T08:05:16Z","title":"SWE-Cycle: Benchmarking Code Agents across the Complete Issue Resolution Cycle","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-14T18:34:39.997353Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.13139"},"observation_digest":"sha256:7f016d864113f19c8bdbe4c4a3b23902f1ee17bb0d746b80b46ec7fbc3c5cf9a","observation_id":"0acde9b6-8974-44b9-87c6-d7fdf97d1b18","resolution":{"observed_at":"2026-05-14T18:37:35.740135Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.13625","last_updated":"2026-05-13T14:52:40Z","snapshot_observed_at":"2026-07-06T23:25:11.623026Z","submitted_at":"2026-05-13T14:52:40Z","title":"How to Interpret Agent Behavior","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-14T18:23:25.269217Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.13625"},"observation_digest":"sha256:9ee9e64542194da8454130fc80648fbf3787b956815df576d688f3e29823d4b3","observation_id":"2639d896-4d4d-43ca-ac22-3981adf1b8c4","resolution":{"observed_at":"2026-05-14T18:29:22.800113Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.13848","last_updated":"2026-03-08T18:32:28Z","snapshot_observed_at":"2026-07-06T23:25:21.032938Z","submitted_at":"2026-03-08T18:32:28Z","title":"GraphBit: A Graph-based Agentic Framework for Non-Linear Agent Orchestration","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-15T14:33:51.477306Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.13848"},"observation_digest":"sha256:ac0981790018d709b7492b3f81453d5278a1c200c1851ebbb2a731d7f631cae1","observation_id":"015b8f16-31a5-4565-bee2-1d8bf13ff9b3","resolution":{"observed_at":"2026-05-15T14:35:55.770773Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.14865","last_updated":"2026-05-14T14:12:39Z","snapshot_observed_at":"2026-08-03T03:36:04.990138Z","submitted_at":"2026-05-14T14:12:39Z","title":"Holistic Evaluation and Failure Diagnosis of AI Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T03:17:28.794622Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.14865"},"observation_digest":"sha256:92e94a3eab19dc23c18b935e1010d10eaed56cc841e8b674867b0697e0bbf709","observation_id":"ada85bc4-5a6c-4c9f-ba31-cf85c101a1dd","resolution":{"observed_at":"2026-05-15T03:19:43.254626Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.14892","last_updated":"2026-05-15T09:12:41Z","snapshot_observed_at":"2026-08-05T08:21:06.172969Z","submitted_at":"2026-05-14T14:36:13Z","title":"Beyond Individual Intelligence: Surveying Collaboration, Failure Attribution, and Self-Evolution in LLM-based Multi-Agent Systems","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-15T03:07:38.232966Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.14892"},"observation_digest":"sha256:8a45375f0807b36ba157429fd83ae2d7b364547b795e1a339a027f36a04ed9cd","observation_id":"86734d7a-0863-4ef4-b020-d075004c5ade","resolution":{"observed_at":"2026-05-15T03:08:57.752402Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.14892","last_updated":"2026-05-15T09:12:41Z","snapshot_observed_at":"2026-08-05T08:21:06.172969Z","submitted_at":"2026-05-14T14:36:13Z","title":"Beyond Individual Intelligence: Surveying Collaboration, Failure Attribution, and Self-Evolution in LLM-based Multi-Agent Systems","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-19T16:51:13.491389Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.14892"},"observation_digest":"sha256:3721f7607ae747696397fa83c1ff88171a6a67f24cb968dbd304729b3c6e5403","observation_id":"54c43af5-ada6-4c12-9d59-7390a2c0b779","resolution":{"observed_at":"2026-05-19T16:52:39.937460Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.15207","last_updated":"2026-07-08T14:36:15Z","snapshot_observed_at":"2026-07-12T17:52:34.996306Z","submitted_at":"2026-05-01T23:42:57Z","title":"TeamTR: Trust-Region Fine-Tuning for Multi-Agent LLM Coordination","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-19T18:01:06.649723Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.15207"},"observation_digest":"sha256:7fae76331f657e276b4d95894d3e06808cbf7e96f3e216eed6181fb764095a77","observation_id":"21980877-5a72-43af-8b5b-ce8c4d474fb4","resolution":{"observed_at":"2026-05-19T18:02:42.069950Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.15565","last_updated":"2026-05-15T03:13:35Z","snapshot_observed_at":"2026-08-03T02:43:16.115285Z","submitted_at":"2026-05-15T03:13:35Z","title":"AstraFlow: Dataflow-Oriented Reinforcement Learning for Agentic LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-20T20:10:32.300423Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.15565"},"observation_digest":"sha256:50e478d20120ee79fbc276b926936cfc94dc01c06baeb888297e5708c021e704","observation_id":"64a59955-792c-4894-8561-9c2230e39d4a","resolution":{"observed_at":"2026-05-20T20:13:43.821503Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.17467","last_updated":"2026-05-17T14:09:35Z","snapshot_observed_at":"2026-08-06T21:09:28.638230Z","submitted_at":"2026-05-17T14:09:35Z","title":"VerifyMAS: Hypothesis Verification for Failure Attribution in LLM Multi-Agent Systems","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-20T12:57:19.545442Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.17467"},"observation_digest":"sha256:cabc67f7df3208b697ed3ca130eacc430db1e7710ced30bcefad5823ed4c8a93","observation_id":"cd817ec4-43ec-4f51-9782-a02f7c3ea265","resolution":{"observed_at":"2026-05-20T12:58:17.699454Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.18672","last_updated":"2026-05-18T17:13:41Z","snapshot_observed_at":"2026-08-07T00:59:54.038840Z","submitted_at":"2026-05-18T17:13:41Z","title":"Position: A Three-Layer Probabilistic Assume-Guarantee Architecture Is Structurally Required for Safe LLM Agent Deployment","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-20T10:21:11.725387Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.18672"},"observation_digest":"sha256:e28f740cf2c23315d8e4af2a0352c1d71559e66498022cb9481ad8aee1b4800b","observation_id":"226a6da8-c4ed-4eea-991d-49c32abb8a16","resolution":{"observed_at":"2026-05-20T10:23:12.024102Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.19035","last_updated":"2026-05-18T18:57:54Z","snapshot_observed_at":"2026-08-01T06:09:25.717434Z","submitted_at":"2026-05-18T18:57:54Z","title":"Trustworthy Agent Network: Trust in Agent Networks Must Be Baked In, Not Bolted On","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-20T10:31:16.368065Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.19035"},"observation_digest":"sha256:d4a3beb284e27d6b1d05fe78cc3fcd9c8da33f473935ba044094bb670e9bb4bb","observation_id":"2a6b07a9-19fb-42a2-880d-ef3a2ea16da6","resolution":{"observed_at":"2026-05-20T10:33:12.356069Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.20086","last_updated":"2026-05-19T16:41:45Z","snapshot_observed_at":"2026-08-02T02:17:19.395211Z","submitted_at":"2026-05-19T16:41:45Z","title":"What Do Evolutionary Coding Agents Evolve?","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-20T03:44:18.658541Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.20086"},"observation_digest":"sha256:fbe3834eb75983823252d72316789b1cfa055023391c83bddc65c30667c3e63a","observation_id":"66159a0c-0bd5-4879-96d0-eeda4a16ce45","resolution":{"observed_at":"2026-05-20T03:48:03.044997Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.20173","last_updated":"2026-05-19T17:54:21Z","snapshot_observed_at":"2026-07-06T23:30:49.211483Z","submitted_at":"2026-05-19T17:54:21Z","title":"A Methodology for Selecting and Composing Runtime Architecture Patterns for Production LLM Agents","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T04:52:24.576085Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.20173"},"observation_digest":"sha256:c3ff626a4035934e2e62514fb21a28c9d313ea8dc515b7587cc8377d1ea3b55a","observation_id":"686e88ac-5580-4ccd-b849-a84b66291f0f","resolution":{"observed_at":"2026-05-20T04:53:04.205456Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.20312","last_updated":"2026-05-19T17:00:33Z","snapshot_observed_at":"2026-07-06T23:30:53.900592Z","submitted_at":"2026-05-19T17:00:33Z","title":"Pramana: A Protocol-Layer Treatment of Claim Verification in Autonomous Agent Networks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-21T02:10:13.030288Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.20312"},"observation_digest":"sha256:f47e367c2fc0a957c6f061a438761fbb43986d83ef3b9fcf9bcccc63f68ff166","observation_id":"f1d6aca6-7ba8-4c81-9bb6-789c86250402","resolution":{"observed_at":"2026-05-21T02:13:56.440467Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.20478","last_updated":"2026-05-19T20:41:35Z","snapshot_observed_at":"2026-08-02T17:54:31.452156Z","submitted_at":"2026-05-19T20:41:35Z","title":"Stage-Audit: Auditable Source-Frontier Discovery for Cross-Wiki Tables","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-21T07:13:28.742008Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.20478"},"observation_digest":"sha256:72321177040b43fee2375598ecc21968d71948c40ba98e238c68513a543f5430","observation_id":"d6980f90-b8e6-4341-b0d1-89fd4f074a39","resolution":{"observed_at":"2026-05-21T07:14:02.553228Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":"2503.13657","doi":"10.48550/arxiv.2503.13657","metadata_source":"pith","pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Why Do Multi-Agent LLM Systems Fail?","venue":"cs.AI","work_id":"b186294a-cda7-4df0-9a28-27d379af92b2","year":2025},"citing_paper":{"arxiv_id":"2605.20530","last_updated":"2026-05-26T15:53:21Z","snapshot_observed_at":"2026-08-06T21:16:26.077088Z","submitted_at":"2026-05-19T22:05:12Z","title":"AgentAtlas: Beyond Outcome Leaderboards for LLM Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-21T06:34:43.686189Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2605.20530"},"observation_digest":"sha256:10197a1537216a4883f6be2d329237b70af4f34a750ce3124f47e5c5a2b23729","observation_id":"4c0d6594-74a3-41f7-b1bb-31eefb3a3598","resolution":{"observed_at":"2026-05-21T06:39:44.120121Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2503.13657/citation-record","integrity":"/paper/2503.13657/integrity","json":"/paper/2503.13657/citation-record.json","paper":"/paper/2503.13657"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The Russian Messenger","venue":null,"work_id":"97e0c407-bdee-4411-aeaf-9411e666c7c1","year":null},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:9adbc825579ced2d0f6b052309de4b3c5542909813fc2aed99b5e32fff111fe3","observation_id":"61ff6413-ed8d-400f-b145-3fc267efab06","resolution":{"observed_at":"2026-05-12T05:42:59.086478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15334","last_updated":"2023-05-24T16:48:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-24T16:48:11Z","title":"Gorilla: Large Language Model Connected with Massive APIs","version":1},"cited_work":{"arxiv_id":"2305.15334","doi":"10.48550/arxiv.2305.15334","metadata_source":"pith","pith_arxiv_id":"2305.15334","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gorilla: Large Language Model Connected with Massive APIs","venue":"cs.CL","work_id":"126a464a-4a73-495f-b669-de1e44aa8f09","year":2023},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2305.15334","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:42e78051020d91fea8fb00866fcb7321b6abf9d0e91245f1adee5d9276a23c30","observation_id":"30d73cb7-8741-491c-8aad-02e3d9735fc5","resolution":{"observed_at":"2026-05-12T05:42:57.927341Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08560","last_updated":"2024-02-12T18:59:46Z","snapshot_observed_at":"2026-08-03T06:31:15.541423Z","submitted_at":"2023-10-12T17:51:32Z","title":"MemGPT: Towards LLMs as Operating Systems","version":2},"cited_work":{"arxiv_id":"2310.08560","doi":"10.48550/arxiv.2310.08560","metadata_source":"pith","pith_arxiv_id":"2310.08560","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MemGPT: Towards LLMs as Operating Systems","venue":"cs.AI","work_id":"2698f5ad-c84c-40ca-b839-0912dae10ba2","year":2023},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2310.08560","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:2391c672a08b2fc1b9c8cb93c8a826e54276f112acfba3d4c53742693ba0f044","observation_id":"739810f5-f2de-4d15-83a8-f8b5debf6b44","resolution":{"observed_at":"2026-05-12T05:42:57.953690Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:49:35.543803+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:49:35.543803+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on large language model based autonomous agents.Frontiers of Computer Science, 18(6), March","venue":null,"work_id":"ea00f2b2-493e-44a2-948c-e47151fe0ea2","year":null},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:668e9e70e281c28f71e982175716bf12bab65b076510fbc8d04bd4d8ce5e6366","observation_id":"2be0b41e-9503-43cb-8f15-aa85fe0cdfe2","resolution":{"observed_at":"2026-05-12T05:42:59.222791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s11704-024-40231-1","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T13:37:06.774536Z","title":"Frontiers Comput","venue":"Frontiers of Computer Science","work_id":"c00808e5-64e6-4bbb-9a05-230c05403bff","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:189fe345c8531e81ddef78d7f6283a2b0e330eb1da0d9ffd1a03ec727c467435","observation_id":"d8fc0a52-fb7c-4315-8e44-d2d8b16cf673","resolution":{"observed_at":"2026-05-12T05:42:57.789285Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:49:36.593873+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:49:36.593873+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07924","last_updated":"2024-06-05T13:23:49Z","snapshot_observed_at":"2026-07-06T15:54:28.831510Z","submitted_at":"2023-07-16T02:11:34Z","title":"ChatDev: Communicative Agents for Software Development","version":5},"cited_work":{"arxiv_id":"2307.07924","doi":"10.48550/arxiv.2307.07924","metadata_source":"pith","pith_arxiv_id":"2307.07924","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ChatDev: Communicative Agents for Software Development","venue":"cs.SE","work_id":"5d8a3650-ab78-4991-b0d3-5309b59c690f","year":2023},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2307.07924","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:b538c8199cb9dffb2fd98bd14556b3c53e5e4d9759d3bc37033d60d9ee969841","observation_id":"289507db-7e82-40aa-8f49-fd4c3ea96ca4","resolution":{"observed_at":"2026-05-12T20:32:47.766951Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16741","last_updated":"2025-04-18T18:14:31Z","snapshot_observed_at":"2026-08-02T14:58:44.167588Z","submitted_at":"2024-07-23T17:50:43Z","title":"OpenHands: An Open Platform for AI Software Developers as Generalist Agents","version":3},"cited_work":{"arxiv_id":"2407.16741","doi":"10.1145/3718958.3750537","metadata_source":"pith","pith_arxiv_id":"2407.16741","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OpenHands: An Open Platform for AI Software Developers as Generalist Agents","venue":"cs.SE","work_id":"f1762ea0-e382-4f38-a28c-adc643789859","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2407.16741","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:450313c3de2c1f6d45ea233bcc08f46bc17431ced6f14a121dd19886b0b96ba2","observation_id":"e7792d97-0692-4dbc-a7ee-a2de045678d0","resolution":{"observed_at":"2026-05-12T05:42:57.822350Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18864","last_updated":"2025-02-26T06:17:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-26T06:17:13Z","title":"Towards an AI co-scientist","version":1},"cited_work":{"arxiv_id":"2502.18864","doi":"10.3917/res.232.0099","metadata_source":"pith","pith_arxiv_id":"2502.18864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards an AI co-scientist","venue":"cs.AI","work_id":"485486b1-a1a2-4cde-bdda-768930c403e6","year":2025},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2502.18864","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:46ede0db173b0d25934f46368e91e66edb4833889c719449ca3c0e167043b948","observation_id":"ff7b9938-c3a4-4e05-af23-08a973b8e3a6","resolution":{"observed_at":"2026-05-12T05:42:57.840350Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bulaong, John E","venue":null,"work_id":"a284e72d-c19f-44b8-83c2-dd54c030ef7c","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:803ffcd92beb1583f6128f54481b993f4e6d8b36032199e40172be054dd5072e","observation_id":"6f61f12a-a9eb-4ac2-9852-6d115ab39dd8","resolution":{"observed_at":"2026-05-12T05:42:59.139101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03442","last_updated":"2023-08-06T00:21:19Z","snapshot_observed_at":"2026-07-06T15:13:13.695535Z","submitted_at":"2023-04-07T01:55:19Z","title":"Generative Agents: Interactive Simulacra of Human Behavior","version":2},"cited_work":{"arxiv_id":"2304.03442","doi":"10.1001/jamapsychiatry.2022.0609","metadata_source":"pith","pith_arxiv_id":"2304.03442","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Generative Agents: Interactive Simulacra of Human Behavior","venue":"cs.HC","work_id":"01f7ddaa-284a-441a-be87-921aad4dc54b","year":2023},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2304.03442","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:370bdaa8dbae30ad11cfd9eba40844ff042a26e153a5522a9053ae2de83df792","observation_id":"68060de7-0d56-463e-af98-e41ec3c3486d","resolution":{"observed_at":"2026-05-12T05:42:57.864354Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-24T05:54:33.103795+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T05:54:33.103795+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Openmanus: An open- source framework for building general ai agents","venue":null,"work_id":"ec9abbb1-54f6-47c9-bedf-cd2b6f5c63a5","year":2025},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:d0eeac02a13c3c7cae5260b65be9a9a523eb592247a4d787b3e11ed6f6bfcd40","observation_id":"1ab56c37-0cca-49d3-9e3f-6e1f88b44fa2","resolution":{"observed_at":"2026-05-12T05:42:58.958156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04468","last_updated":"2024-11-07T06:36:19Z","snapshot_observed_at":"2026-08-04T17:52:28.620519Z","submitted_at":"2024-11-07T06:36:19Z","title":"Magentic-One: A Generalist Multi-Agent System for Solving Complex Tasks","version":1},"cited_work":{"arxiv_id":"2411.04468","doi":"10.48550/arxiv.2411.04468","metadata_source":"pith","pith_arxiv_id":"2411.04468","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Magentic-One: A Generalist Multi-Agent System for Solving Complex Tasks","venue":"cs.AI","work_id":"7041cf9c-a528-465d-8bec-028e02e47d3d","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2411.04468","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:c56cdf350d7f98c6506b4ef975bcfc13b4490e701719c06fa7daec3aa169b566","observation_id":"197f52d8-f6e5-4328-a48e-8a9bbd61eb46","resolution":{"observed_at":"2026-05-16T18:49:38.916324Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-20T18:52:14.738339+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T18:52:14.738339+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04834","last_updated":"2025-07-18T05:02:11Z","snapshot_observed_at":"2026-07-06T17:56:40.208379Z","submitted_at":"2024-04-07T07:05:40Z","title":"LLM-Based Multi-Agent Systems for Software Engineering: Literature Review, Vision and the Road Ahead","version":4},"cited_work":{"arxiv_id":"2404.04834","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.04834","snapshot_observed_at":"2026-07-01T14:15:47.484231Z","title":"Llm-based multi-agent systems for software engineering: Literature review, vision and the road ahead","venue":null,"work_id":"d75ab58c-50b6-4436-b759-e0235456fa94","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2404.04834","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:b38366917df0352b79638f3c297f5546075a21afe9f8c2b552f9788b823459c3","observation_id":"5cb7e049-d3a9-4696-9a7a-5284781f0c53","resolution":{"observed_at":"2026-05-12T05:42:58.005346Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04738","last_updated":"2023-07-10T17:52:01Z","snapshot_observed_at":"2026-07-06T15:52:17.512993Z","submitted_at":"2023-07-10T17:52:01Z","title":"RoCo: Dialectic Multi-Robot Collaboration with Large Language Models","version":1},"cited_work":{"arxiv_id":"2307.04738","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.04738","snapshot_observed_at":"2026-07-01T09:55:40.216265Z","title":"Roco: Dialectic multi-robot collaboration with large language models","venue":null,"work_id":"d62b3ea3-1da6-459b-a035-f2bd33fcd4fb","year":2023},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2307.04738","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:ae2f8a50f22d5ddd84aa8a379da111ef1fee59ebb60b71dc74a9188b210867ee","observation_id":"6e3ded65-c98a-43eb-9c1d-9d77336f8bb6","resolution":{"observed_at":"2026-05-12T05:42:58.031352Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02485","last_updated":"2024-02-17T05:27:56Z","snapshot_observed_at":"2026-08-02T22:53:12.613357Z","submitted_at":"2023-07-05T17:59:27Z","title":"Building Cooperative Embodied Agents Modularly with Large Language Models","version":2},"cited_work":{"arxiv_id":"2307.02485","doi":"10.48550/arxiv.2307.02485","metadata_source":"pith","pith_arxiv_id":"2307.02485","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2307.02485 , year=","venue":"cs.AI","work_id":"43dfc983-b0e8-4a51-a15f-665fe191963b","year":2023},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2307.02485","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:0a9e519d4529ffef1781d88af35bad179b1bbdd61c768d8b4f0fe4cb4ac6e2a8","observation_id":"8c030740-caa6-4091-8189-afef68b8e6ab","resolution":{"observed_at":"2026-05-12T05:42:58.054690Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14325","last_updated":"2023-05-23T17:55:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-23T17:55:11Z","title":"Improving Factuality and Reasoning in Language Models through Multiagent Debate","version":1},"cited_work":{"arxiv_id":"2305.14325","doi":"10.48550/arxiv.2305.14325","metadata_source":"pith","pith_arxiv_id":"2305.14325","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Improving Factuality and Reasoning in Language Models through Multiagent Debate","venue":"cs.CL","work_id":"a543e65c-1cf8-4182-b03b-33c0cd2c65d5","year":2023},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2305.14325","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:b5c4af805bf263a7f444d2a29803f3941921cb9cf0adc08330837f7852920251","observation_id":"22699795-244b-4224-a549-2d2c103e8fa8","resolution":{"observed_at":"2026-05-12T05:42:58.064340Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T21:45:40.415341Z","title":"Generative agents: Interactive simulacra of human behavior","venue":null,"work_id":"024025c0-77a0-4b52-8e95-b99784b54e81","year":2023},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:d2613f47d8c180bbb33febf439a4058acce64df4e014ab69a148ececf201e396","observation_id":"69f7bd8d-e1e6-4c88-bf55-74b2a0f09ac9","resolution":{"observed_at":"2026-05-12T05:42:58.989078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01680","last_updated":"2024-04-19T01:15:16Z","snapshot_observed_at":"2026-08-06T19:10:15.466826Z","submitted_at":"2024-01-21T23:36:14Z","title":"Large Language Model based Multi-Agents: A Survey of Progress and Challenges","version":2},"cited_work":{"arxiv_id":"2402.01680","doi":"10.48550/arxiv.2402.01680","metadata_source":"pith","pith_arxiv_id":"2402.01680","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large Language Model based Multi-Agents: A Survey of Progress and Challenges","venue":"cs.CL","work_id":"fb905249-ea5f-4765-80f0-2428ea66f15f","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2402.01680","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:03ac4a5aaefa355a23c15f703d92424fa71d2b3041376a0a2e014564b405d9f1","observation_id":"819c299a-6a67-447a-80dc-cdd197ee4c6b","resolution":{"observed_at":"2026-05-12T06:58:59.611495Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01489","last_updated":"2024-10-29T17:29:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-01T17:24:45Z","title":"Agentless: Demystifying LLM-based Software Engineering Agents","version":2},"cited_work":{"arxiv_id":"2407.01489","doi":"10.48550/arxiv.2407.01489","metadata_source":"pith","pith_arxiv_id":"2407.01489","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agentless: Demystifying LLM-based Software Engineering Agents","venue":"cs.SE","work_id":"71c901c4-3c83-4e10-af54-3daef7fff397","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2407.01489","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:519c33c8bfa9851c005ff7d7c9a8943f7eb056ce3f948aab1d6b6d04c1d508a5","observation_id":"b9241fc1-66a4-4191-8246-69cbb53f4f58","resolution":{"observed_at":"2026-05-12T05:42:58.120345Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:50:51.153796+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:50:51.153796+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01502","last_updated":"2024-07-01T17:48:14Z","snapshot_observed_at":"2026-08-06T22:15:08.500389Z","submitted_at":"2024-07-01T17:48:14Z","title":"AI Agents That Matter","version":1},"cited_work":{"arxiv_id":"2407.01502","doi":"10.48550/arxiv.2407.01502","metadata_source":"pith","pith_arxiv_id":"2407.01502","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Siegel, Nitya Nadgir, and Arvind Narayanan","venue":"cs.LG","work_id":"07877e57-5393-47ee-ae5f-563ff8f9a6b2","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2407.01502","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:1722de75455ffb54673f9e74de209d3193e37ae4c3aa1d180ef646db20da8fa9","observation_id":"f88d505d-a470-4893-bbeb-191600d0fc84","resolution":{"observed_at":"2026-05-12T05:42:58.133915Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:07.572928+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:07.572928+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Glaser and Anselm L","venue":null,"work_id":"9f780a5b-8676-4b61-9afd-133664889f45","year":1967},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:3312bbf872e1ec679d85431022925ec26cae001e15b90a6f5c0c497b49ff72e9","observation_id":"76aece85-d3b4-4ef2-9e67-abde5836d2f1","resolution":{"observed_at":"2026-05-12T05:42:59.016164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05685","last_updated":"2023-12-24T02:01:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-09T05:55:52Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","version":4},"cited_work":{"arxiv_id":"2306.05685","doi":"10.1109/4235.797969","metadata_source":"pith","pith_arxiv_id":"2306.05685","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","venue":"cs.CL","work_id":"d0c30cd7-81e1-4159-a87f-f6adca77ff08","year":2023},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2306.05685","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:4a7844ef45d7fea71f006673a7a0d91603257a5df5113e435bfeede01892df60","observation_id":"9315eda1-2d6a-4f23-9543-8901b8611b92","resolution":{"observed_at":"2026-05-12T05:42:58.153412Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Agent workflow memory","venue":null,"work_id":"159f8f6a-6041-4e09-b682-0bd7c3339d0a","year":null},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:8f7684b96c634f5758a09d6099bd28aa657bd91dbfd422f3e034221daee4a796","observation_id":"43bad753-8a20-4036-a87a-196bb82a0957","resolution":{"observed_at":"2026-05-12T05:42:59.028666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07429","last_updated":"2024-09-11T17:21:00Z","snapshot_observed_at":"2026-07-30T13:07:16.440141Z","submitted_at":"2024-09-11T17:21:00Z","title":"Agent Workflow Memory","version":1},"cited_work":{"arxiv_id":"2409.07429","doi":"10.48550/arxiv.2409.07429","metadata_source":"pith","pith_arxiv_id":"2409.07429","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agent Workflow Memory","venue":"cs.CL","work_id":"c81e2e3e-49d4-46f5-9a82-76e8d00fef1d","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2409.07429","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:7545b8b5d2846decce40780724441f3a686f4770316b113d5d5e4ee84860a83a","observation_id":"1f4fec5a-73f5-46b0-ab73-9bf82acd8315","resolution":{"observed_at":"2026-05-15T00:51:28.546876Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-01T10:08:10.022945+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T10:08:10.022945+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03714","last_updated":"2023-10-05T17:37:25Z","snapshot_observed_at":"2026-08-04T05:21:05.846165Z","submitted_at":"2023-10-05T17:37:25Z","title":"DSPy: Compiling Declarative Language Model Calls into Self-Improving Pipelines","version":1},"cited_work":{"arxiv_id":"2310.03714","doi":"10.48550/arxiv.2310.03714","metadata_source":"pith","pith_arxiv_id":"2310.03714","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DSPy: Compiling Declarative Language Model Calls into Self-Improving Pipelines","venue":"cs.CL","work_id":"d490f594-f5fc-47b0-ae6a-6550e50fe095","year":2023},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2310.03714","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:c4afc21abd1621133bd67e509374f5f7d0c9e33963e493e59c1f3d41cfafc011","observation_id":"6bf491c2-5f10-49ad-adcc-6822fcc4f1e7","resolution":{"observed_at":"2026-05-12T05:42:58.196027Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stateflow: Enhancing llm task-solving through state-driven workflows","venue":null,"work_id":"0c7c8588-2293-4b2c-a1aa-40038b8a897f","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:07a3141df544b71ba5454b0be26b8c3071407f8080dcb6c70d4c8cdc108adb96","observation_id":"02f7ae35-578a-49de-8868-30e0af2f459c","resolution":{"observed_at":"2026-05-12T05:42:59.042463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03578","last_updated":"2026-01-28T04:55:23Z","snapshot_observed_at":"2026-07-06T17:25:53.950578Z","submitted_at":"2024-02-05T23:06:42Z","title":"LLM Multi-Agent Systems: Challenges and Open Problems","version":3},"cited_work":{"arxiv_id":"2402.03578","doi":"10.48550/arxiv.2402.03578","metadata_source":"pith","pith_arxiv_id":"2402.03578","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLM Multi-Agent Systems: Challenges and Open Problems","venue":"cs.MA","work_id":"c39b4786-4cab-4eaa-88c0-f2402c17c059","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2402.03578","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:5ad8ad2753ace8a438977bc125bcd99cd1e4cb2a9c715bd9078f243f2bde259f","observation_id":"ec8f5d8f-f827-4222-9d93-c188ce57ff1b","resolution":{"observed_at":"2026-05-17T10:23:05.283434Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14143","last_updated":"2025-02-19T23:03:21Z","snapshot_observed_at":"2026-07-06T20:39:28.583884Z","submitted_at":"2025-02-19T23:03:21Z","title":"Multi-Agent Risks from Advanced AI","version":1},"cited_work":{"arxiv_id":"2502.14143","doi":"10.48550/arxiv.2502.14143","metadata_source":"pith","pith_arxiv_id":"2502.14143","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2502.14143 , year=","venue":"cs.MA","work_id":"5c63297e-2866-40b6-878d-2bdbe3c0fdc7","year":2025},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2502.14143","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:6b8c0e85545e2b4401c3807f16498093cbaa34ccd84d46ca6b5d47579b3dd107","observation_id":"fbbc47ce-ded6-422f-a4fd-2d44427b6b2e","resolution":{"observed_at":"2026-05-12T05:42:58.257297Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-15T18:20:35.094728+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T18:20:35.094728+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T13:53:48.663760Z","title":"SWE-bench: Can language models resolve real-world github issues? InThe Twelfth International Conference on Learning Representations","venue":null,"work_id":"7b2cf690-94b5-4050-94c2-ca01d4212a1c","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:add270a6231402cf93898e6e638310282411a91eea6b334b210f6b64c58c24d5","observation_id":"0cb7e8d4-7b29-481a-848d-ce047df9db41","resolution":{"observed_at":"2026-05-12T05:42:59.066110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00936","last_updated":"2024-06-03T02:20:03Z","snapshot_observed_at":"2026-07-06T18:24:09.535762Z","submitted_at":"2024-06-03T02:20:03Z","title":"A Survey of Useful LLM Evaluation","version":1},"cited_work":{"arxiv_id":"2406.00936","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.00936","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey of useful llm evaluation","venue":null,"work_id":"44b9095f-69ee-46f8-993e-c86e726667e0","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2406.00936","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:5012dac33d9d75c184c3920f10cb8be85653249e99704cf7ac479ad55f59631d","observation_id":"e4b2aea3-1b1e-48ea-96ca-70234cfbe3da","resolution":{"observed_at":"2026-05-12T05:42:58.268435Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15971","last_updated":"2024-08-28T17:43:55Z","snapshot_observed_at":"2026-07-06T19:07:16.252072Z","submitted_at":"2024-08-28T17:43:55Z","title":"BattleAgentBench: A Benchmark for Evaluating Cooperation and Competition Capabilities of Language Models in Multi-Agent Systems","version":1},"cited_work":{"arxiv_id":"2408.15971","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.15971","snapshot_observed_at":"2026-07-02T22:57:26.233385Z","title":"Battleagentbench: A benchmark for evaluating cooperation and competition capabilities of language models in multi-agent systems.arXiv preprint arXiv:2408.15971","venue":null,"work_id":"17ce7da6-3ca0-4fb9-af61-311cc7c0d2e0","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2408.15971","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:e2372bedec84bdcbbbe0608061335d0d53199ca3241a0b5386d93fb88c2e7e5d","observation_id":"bdeb7504-dd83-401b-9027-98444f02d6a4","resolution":{"observed_at":"2026-05-12T05:42:57.912351Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11761","last_updated":"2025-04-22T11:24:23Z","snapshot_observed_at":"2026-08-06T12:28:11.548894Z","submitted_at":"2024-12-16T13:25:42Z","title":"Harnessing Language for Coordination: A Framework and Benchmark for LLM-Driven Multi-Agent Control","version":2},"cited_work":{"arxiv_id":"2412.11761","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.11761","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Harnessing language for coordination: A framework and benchmark for llm-driven multi-agent control","venue":null,"work_id":"ff95fefe-44fe-42f8-b579-0d79fe80fc05","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2412.11761","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:0bf5c63b40a5b0f26bfbf53e702a0e3cd1ab67a3d36db3b9de1935c2c727d60e","observation_id":"2bf167ad-24cb-45e8-a4e5-9a886f6d5e15","resolution":{"observed_at":"2026-05-12T05:42:58.301175Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Benchmarl: Benchmarking multi-agent reinforcement learning.Journal of Machine Learning Research, 25(217):1–10","venue":null,"work_id":"07024396-2623-4ca7-ae5e-1cc5229d584a","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:4e50fe17837e711ad955bd11ff11c2ab8dea8d277cbe1d081d2e12d1cadcd932","observation_id":"bfe1c119-9768-43f8-b818-46f5e005ea21","resolution":{"observed_at":"2026-05-12T05:42:59.098835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05255","last_updated":"2024-12-06T18:41:16Z","snapshot_observed_at":"2026-08-03T09:04:15.998560Z","submitted_at":"2024-12-06T18:41:16Z","title":"TeamCraft: A Benchmark for Multi-Modal Multi-Agent Systems in Minecraft","version":1},"cited_work":{"arxiv_id":"2412.05255","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.05255","snapshot_observed_at":"2026-07-04T00:39:17.292874Z","title":"TeamCraft: A benchmark for multi-modal multi-agent systems in minecraft","venue":null,"work_id":"cd5ef82c-46c9-4242-9f02-9471401628d6","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2412.05255","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:c33bd9a9d0e623afa1b3a399a877f449ac37e6123d23fca5690af3958019afba","observation_id":"d363ce66-e698-482b-be4a-0fa0f8c33924","resolution":{"observed_at":"2026-05-12T05:42:58.311345Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":"2308.05374","doi":"10.3390/su15053939","metadata_source":"pith","pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","venue":"cs.AI","work_id":"d518ae99-5488-4834-83a4-63e88f9878dc","year":2023},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:37b461d5a6aa0d63ba615e1767ca10a5dc9441145a1d29d095d460a82453e213","observation_id":"1e092785-dddf-40bf-9b52-4e4d4e51c9c4","resolution":{"observed_at":"2026-05-12T05:42:58.329329Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on large language model (llm) security and privacy: The good, the bad, and the ugly.High-Confidence Computing, page 100211","venue":null,"work_id":"e53173ae-8073-46f9-9589-8405d9006e2b","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:08260260272d2ec9d67bc921513cbf9266408e74a643f67195d370cd64436db4","observation_id":"ee79bb8e-fe6e-4747-ace5-a05f1fced8e6","resolution":{"observed_at":"2026-05-12T05:42:59.119414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"URL https://www.anthropic.com/research/ building-effective-agents","venue":null,"work_id":"d15e74ef-ce53-4bce-bc57-a3edd420f27d","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:7e233bcc5cb1ce0ef0dab5d0243673a5bb1b90bf50fd1ecf7c50cfdeaeefaabc","observation_id":"534af70f-8c47-4fd0-9529-0f42c07a51b2","resolution":{"observed_at":"2026-05-12T05:42:59.122634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05299","last_updated":"2024-12-16T08:17:09Z","snapshot_observed_at":"2026-07-06T20:03:02.297824Z","submitted_at":"2024-11-25T07:48:31Z","title":"Specifications: The missing link to making the development of LLM systems an engineering discipline","version":2},"cited_work":{"arxiv_id":"2412.05299","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.05299","snapshot_observed_at":"2026-07-01T14:15:47.138504Z","title":"Specifications: The miss- ing link to making the development of LLM systems an engineering discipline","venue":null,"work_id":"c477bfa5-1e99-4e6a-81e1-06a39824a187","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2412.05299","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:3eda50cc143b34738dedc9661866a83af48d8645afac4a1c45295ab755a1558d","observation_id":"f67b68d8-dae0-444b-bfcb-58605e6c90cc","resolution":{"observed_at":"2026-05-12T05:42:58.337875Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0fc12770-d3c3-45d8-bb15-d7c652b6043b","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:e4941cee2caf43a86d2c5900548bd4a3bbd5eafdae9cd2707ea630feb77fbc33","observation_id":"a879c327-8242-4f7b-adf4-75bec7d01a31","resolution":{"observed_at":"2026-05-12T05:42:59.132387Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:47:46.776388Z","title":"Knowledge-Centric Hallucination Detection","venue":null,"work_id":"557a574b-31bd-4f07-9bd0-47bc7c74bcd8","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:0d61c4a840946056f05f2029a301c090165344344e18921352b9bf13be7642d2","observation_id":"488ea8cb-c884-4d73-b2a8-6a8dc9c70931","resolution":{"observed_at":"2026-05-12T05:42:57.775599Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-01T04:38:47.367793+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T04:38:47.367793+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An empirical study of code generation errors made by large language models","venue":null,"work_id":"c9716fb0-e255-4b95-96b0-d60acd5f116c","year":2023},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:327215d24ec234ab83e27e59c172c69458ec80911813f670e46da45b56a83fbd","observation_id":"c7000d0f-d0ec-403d-ac01-376e7a799e33","resolution":{"observed_at":"2026-05-12T05:42:59.146953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02178","last_updated":"2024-05-12T15:52:49Z","snapshot_observed_at":"2026-08-01T23:45:07.491218Z","submitted_at":"2024-05-03T15:26:27Z","title":"Assessing and Verifying Task Utility in LLM-Powered Applications","version":2},"cited_work":{"arxiv_id":"2405.02178","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.02178","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f7f32c21-a6ff-4cdd-8a7a-632c462bca03","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2405.02178","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:ed214986cdfd72bd9c38a85aa7f5d0c817139079b653398f6af20f5b81fa5482","observation_id":"7f3758a2-5fb9-45e3-b4fb-4cacc9f103ee","resolution":{"observed_at":"2026-05-12T05:42:58.371011Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.02068","last_updated":"2025-03-03T21:42:54Z","snapshot_observed_at":"2026-07-06T20:46:04.250876Z","submitted_at":"2025-03-03T21:42:54Z","title":"Interactive Debugging and Steering of Multi-Agent AI Systems","version":1},"cited_work":{"arxiv_id":"2503.02068","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.02068","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Interactive debugging and steering of multi-agent ai systems","venue":null,"work_id":"01cfaa9e-7001-4858-a1d4-65a061226070","year":2025},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2503.02068","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:fadba904f259cf0c36c407dbc5670f76c760ec9477b831d895f8e832831ada6a","observation_id":"0481156e-a12a-4d0a-872e-0502e1affda4","resolution":{"observed_at":"2026-05-12T05:42:58.388577Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-03T07:21:18.158607Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":"2505.00212","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-07-08T11:24:54.802233Z","title":"arXiv preprint arXiv:2505.00212 , year=","venue":"cs.MA","work_id":"68ab7507-80d4-4299-9201-c3e7d0bc9a19","year":2025},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:13ffcc7954ad8c12b1436a41e1d823ba2cf5da71420a932fdc4706affdc2e0e2","observation_id":"3d8cb982-91c4-47b9-a72c-c8dbaaee7738","resolution":{"observed_at":"2026-05-12T05:42:58.410764Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Theoretical sampling and category development in grounded theory.Qualitative health research, 17(8): 1137–1148","venue":null,"work_id":"801fa653-7813-4b04-9ea4-f38c3887e28d","year":2007},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:9ca5c801901fab191a315e1113ff1ceef9649594ea38b805c7563eb649765f6a","observation_id":"6672edff-68b5-4e42-ae70-e127df2829c5","resolution":{"observed_at":"2026-05-12T05:42:59.175408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Open coding.University of Calgary, 23(2009):2009","venue":null,"work_id":"6583b745-167f-4911-938e-23f48c281d1c","year":2009},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:5715d67a23aa7342fcb5eb2ddc34e5af5e9cf84afe0ab33b6816b0038cb3d17f","observation_id":"3822f4d1-a368-4adc-adf1-860a1b49dc64","resolution":{"observed_at":"2026-05-12T05:42:59.180694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Manus.https://manus.im/","venue":null,"work_id":"72cbcc7f-3fa0-4bdd-ab5f-16e99560056f","year":2025},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:6f64b3b9ae645b7ea1c62e9a66fcfa4e2b5e8c0efd33dc491b1f5037a3364eb8","observation_id":"93dc3548-4106-4b5f-8a8d-aa4bf1ec12ba","resolution":{"observed_at":"2026-05-12T05:42:59.189479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Model context protocol: Introduction","venue":null,"work_id":"fe0ee663-45a0-4708-bd37-06282c0cfd9d","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:cc5737eb7fc7186e313256e03c96c18ac17ba254ad97c8df6233595334a5fdb7","observation_id":"cdf93fb5-9a18-4f3a-bc2c-5f97e5cb84ab","resolution":{"observed_at":"2026-05-12T05:42:59.194925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A2a: A new era of agent interoperability, April 2025","venue":null,"work_id":"5620acb3-e526-4250-b011-a483cf68d4ac","year":2025},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:b1f9bcd02a288e6d639ef561339f98e35c682e5109e5a471803c7a040809a034","observation_id":"46d1ea93-1e51-4569-8cba-909fad376b42","resolution":{"observed_at":"2026-05-12T05:42:59.199428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03903","last_updated":"2025-04-28T20:21:54Z","snapshot_observed_at":"2026-08-03T22:05:44.738329Z","submitted_at":"2023-10-05T21:18:15Z","title":"LLM-Coordination: Evaluating and Analyzing Multi-agent Coordination Abilities in Large Language Models","version":3},"cited_work":{"arxiv_id":"2310.03903","doi":"10.1016/j.tics.2018.11.003","metadata_source":"pith","pith_arxiv_id":"2310.03903","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llm-coordination: evaluating and analyzing multi-agent coordination abilities in large language models","venue":"cs.CL","work_id":"0a23ea9e-3982-41df-9ae6-e213be69c811","year":2023},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2310.03903","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:7f42985ec1c56dc2bba1ff35413ddb5ccbfd1809fbe9973235892dbeaad9dfa9","observation_id":"5fd00d40-91c8-4e84-a229-a570db94bb0b","resolution":{"observed_at":"2026-05-12T05:42:58.424334Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Princeton University Press, Princeton, NJ","venue":null,"work_id":"1001a5d5-9231-4a47-b04d-e759d917cf36","year":1984},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:5239c66db835a9cbffd490a003c4efb4845f3558a48ebbc69246889f467b74a4","observation_id":"127dfd1f-2b8b-47aa-a8d6-5a92e26188a7","resolution":{"observed_at":"2026-05-12T05:42:59.216199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/108602668900300202","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Industrial Crisis Quarterly","work_id":"7b72f3ea-c3a4-4730-8817-6991d6367610","year":1989},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:a4736543580bb03069996699f64bc4fa0525e46f6c5d58e12ed32b3c0a321ce2","observation_id":"8e2aaae6-c585-4bfb-834b-3efccca5e045","resolution":{"observed_at":"2026-05-12T05:42:57.760624Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reliable organizations: Present research and future directions.Journal of contingencies and crisis management., 4(2)","venue":null,"work_id":"0b33f0d9-34cc-46d2-b59a-b58e213b41db","year":1996},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:75e66c68f30a02312e676acb3fd6073c330a7d52f5f926e2f96fa807cd83f0d7","observation_id":"b62c6a9a-f836-4065-a7be-645c0eaffc68","resolution":{"observed_at":"2026-05-12T05:42:59.239516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.00352","last_updated":"2024-11-01T14:36:52Z","snapshot_observed_at":"2026-07-06T16:01:07.532053Z","submitted_at":"2023-08-01T07:49:10Z","title":"MetaGPT: Meta Programming for A Multi-Agent Collaborative Framework","version":7},"cited_work":{"arxiv_id":"2308.00352","doi":"10.48550/arxiv.2308.00352","metadata_source":"pith","pith_arxiv_id":"2308.00352","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MetaGPT: Meta Programming for A Multi-Agent Collaborative Framework","venue":"cs.AI","work_id":"891b9780-a800-4e3c-bba0-53597ab8dc98","year":2023},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2308.00352","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:d0cba8c832615858f34ea27fd0b87951ba5b3735cbac2c6ec32733972e5a8101","observation_id":"3ce33145-a8c9-4b76-aa25-9824be35f6c3","resolution":{"observed_at":"2026-05-12T05:42:58.437347Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16299","last_updated":"2025-09-05T08:01:17Z","snapshot_observed_at":"2026-07-06T19:21:20.826877Z","submitted_at":"2024-09-09T19:35:34Z","title":"HyperAgent: Generalist Software Engineering Agents to Solve Coding Tasks at Scale","version":3},"cited_work":{"arxiv_id":"2409.16299","doi":"10.48550/arxiv.2409.16299","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.16299","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Nguyen, and Nghi D","venue":"arXiv (Cornell University)","work_id":"f9295c49-eedd-435f-a92c-83f031ca8e8c","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2409.16299","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:8ac60138ff9486b360a10ec69a30e7c63d5b6eb8d97e638e91f91e45e5794b8d","observation_id":"2a7e4a7b-e169-439b-bfde-44c7809ac945","resolution":{"observed_at":"2026-05-12T05:42:58.484728Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18901","last_updated":"2024-07-26T17:55:45Z","snapshot_observed_at":"2026-08-01T20:19:05.798018Z","submitted_at":"2024-07-26T17:55:45Z","title":"AppWorld: A Controllable World of Apps and People for Benchmarking Interactive Coding Agents","version":1},"cited_work":{"arxiv_id":"2407.18901","doi":"10.48550/arxiv.2407.18901","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.18901","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Trivedi, T","venue":"arXiv (Cornell University)","work_id":"569b9cac-ae96-4656-ab37-26520d82ce78","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2407.18901","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:48545a14fd9b424c841baacf00b9fec310053526af063e21a4770a1beddae988","observation_id":"afc58cd6-4637-44a2-b700-8e99d19c00ed","resolution":{"observed_at":"2026-05-12T05:42:58.505343Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T19:06:27.763605Z","title":"Autogen: Enabling next-gen llm applications via multi-agent conversations","venue":null,"work_id":"e69fa850-2702-4157-995d-2fd40ca48d49","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:2f6bcaefb962f38d9fd72bb05893adade9f263cef83339aea4df6115ca74f165","observation_id":"90a7b087-48b1-40d9-955c-6c37fe9252d3","resolution":{"observed_at":"2026-05-12T05:42:58.785220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chatdev: Communicative agents for software development","venue":null,"work_id":"793ce449-3332-4a23-bc41-e6d02db273b4","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:125d60f6ecde764d2349e85043d60c6dcb0dff4c416decc0bd116ee1fc575847","observation_id":"aa313a61-6bed-4f7d-860a-f09f71a19a6a","resolution":{"observed_at":"2026-05-12T05:42:58.791055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08155","last_updated":"2023-10-03T20:47:10Z","snapshot_observed_at":"2026-07-31T19:03:03.494918Z","submitted_at":"2023-08-16T05:57:52Z","title":"AutoGen: Enabling Next-Gen LLM Applications via Multi-Agent Conversation","version":2},"cited_work":{"arxiv_id":"2308.08155","doi":"10.48550/arxiv.2308.08155","metadata_source":"pith","pith_arxiv_id":"2308.08155","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AutoGen: Enabling Next-Gen LLM Applications via Multi-Agent Conversation","venue":"cs.AI","work_id":"92b7eb9c-c3d8-4518-a376-06fa15dd895b","year":2023},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2308.08155","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:c080aafe89ff79d960b6e24a5485ed554590266b90490f6089d60a987029ce23","observation_id":"392e6512-3e20-4ab3-951b-8c05998b2187","resolution":{"observed_at":"2026-05-12T05:42:58.520447Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:20.607676+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:20.607676+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10541","last_updated":"2024-11-15T19:26:38Z","snapshot_observed_at":"2026-07-06T19:51:09.829522Z","submitted_at":"2024-11-15T19:26:38Z","title":"Does Prompt Formatting Have Any Impact on LLM Performance?","version":1},"cited_work":{"arxiv_id":"2411.10541","doi":"10.48550/arxiv.2411.10541","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.10541","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang, and Sadid Hasan","venue":"arXiv (Cornell University)","work_id":"7f0c939e-059d-47af-9e70-969dfbf791bf","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2411.10541","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:1efb9ec62685d660d88ccfde99b30b2fdfcca95dd92ed4ef5920204118f53f71","observation_id":"b982bc44-7e8b-4abe-a956-ac258d239819","resolution":{"observed_at":"2026-05-12T05:42:58.542908Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03314","last_updated":"2023-06-05T23:55:37Z","snapshot_observed_at":"2026-08-05T20:35:55.884484Z","submitted_at":"2023-06-05T23:55:37Z","title":"Multi-Agent Collaboration: Harnessing the Power of Intelligent LLM Agents","version":1},"cited_work":{"arxiv_id":"2306.03314","doi":"10.48550/arxiv.2306.03314","metadata_source":"pith","pith_arxiv_id":"2306.03314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multi-Agent Collaboration: Harnessing the Power of Intelligent LLM Agents","venue":"cs.AI","work_id":"6ed8494c-c488-407e-b9c0-61e9a411ce26","year":2023},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2306.03314","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:2c07f86e62cdb738b7156787a826b95f6bedf718b8452a99292389aad8a9bb66","observation_id":"bf6b9f6b-54f7-4675-8610-0ef902b0a674","resolution":{"observed_at":"2026-05-12T05:42:58.571343Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07201","last_updated":"2023-08-14T15:13:04Z","snapshot_observed_at":"2026-08-02T01:34:38.978920Z","submitted_at":"2023-08-14T15:13:04Z","title":"ChatEval: Towards Better LLM-based Evaluators through Multi-Agent Debate","version":1},"cited_work":{"arxiv_id":"2308.07201","doi":"10.48550/arxiv.2308.07201","metadata_source":"pith","pith_arxiv_id":"2308.07201","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ChatEval: Towards Better LLM-based Evaluators through Multi-Agent Debate","venue":"cs.CL","work_id":"eac74d79-d8d1-49dd-8565-53d713a84fff","year":2023},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2308.07201","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:a409881948e91f36bfea9342ea6b6a6e8c2ad1d1d96afc1809b01d86e082cb0b","observation_id":"9b5fece2-e11c-4c30-b52f-ee29e96660ed","resolution":{"observed_at":"2026-05-13T13:03:18.868992Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large language models are better reasoners with self-verification","venue":null,"work_id":"2e8994cb-8622-4529-aa5e-d6096c15ccd2","year":2023},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:8e4d1d927b8c13d1bb57c2c87941ab92175dbeea89fff848b56574c73fb29049","observation_id":"ab1bc6ca-0cc0-4f37-84df-077363b012d2","resolution":{"observed_at":"2026-05-12T05:42:58.846353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Langgraph","venue":null,"work_id":"615ad187-92f1-4261-bf64-84ad441bd935","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:dd97717ef31ba2e35ef8553b67dea011cefcfdf79dfa5dfcd0284592d111bd74","observation_id":"2c3592b1-55c2-48d3-be7c-479ce76efd19","resolution":{"observed_at":"2026-05-12T05:42:58.858079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Building effective agents","venue":null,"work_id":"b9a17043-be60-4846-a4fb-0584d702694e","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:93627c33f99a49c917e4ccfdd0ba980734213e8ebc2f3cb2b7051bcbbc6962ff","observation_id":"d930b616-b69d-49c7-9207-6b23c7e93be3","resolution":{"observed_at":"2026-05-12T05:42:58.869595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tree of thoughts: Deliberate problem solving with large language models.Ad- vances in Neural Information Processing Systems, 36","venue":null,"work_id":"40682ed2-5973-44c7-961a-dfa527c032b1","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:359827829b173a6f0ae9e56f33d4b603963fedf0d4456a977680abcfcc35ad5a","observation_id":"c2bb0d4a-dc99-4e63-a4f8-3ed65d7d1f0c","resolution":{"observed_at":"2026-05-12T05:42:58.874105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11527","last_updated":"2024-11-05T01:34:26Z","snapshot_observed_at":"2026-08-06T07:28:40.317418Z","submitted_at":"2024-09-17T19:54:37Z","title":"Improving LLM Reasoning with Multi-Agent Tree-of-Thought Validator Agent","version":2},"cited_work":{"arxiv_id":"2409.11527","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.11527","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fatemeh Haji, Mazal Bethany, Maryam Tabar, Ja- son Chiang, Anthony Rios, and Peyman Najafi- rad","venue":null,"work_id":"4f8596d4-1a48-40f3-8122-3b5ff9e8d83d","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2409.11527","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:b12279a60fe6480ed9d222a43a68040044297c8412095a2855861f31b6fa85ed","observation_id":"23d7d688-411c-4e32-837b-b24e4a024ac6","resolution":{"observed_at":"2026-05-12T05:42:58.611439Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08152","last_updated":"2023-12-17T13:02:27Z","snapshot_observed_at":"2026-07-06T16:47:21.000236Z","submitted_at":"2023-11-14T13:27:07Z","title":"Towards Reasoning in Large Language Models via Multi-Agent Peer Review Collaboration","version":2},"cited_work":{"arxiv_id":"2311.08152","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2311.08152","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards reasoning in large language models via multi-agent peer review collaboration","venue":null,"work_id":"8b06d4ca-d72a-4458-bada-3a1112879c2b","year":2023},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2311.08152","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:2d1d430dd87f15c69a760c205fb1e8e96982b6303d722628877e1c9871826939","observation_id":"1c9cb407-270c-4f22-8b86-125102fb6029","resolution":{"observed_at":"2026-05-12T05:42:58.623989Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2411.17501","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T18:33:50.409598Z","title":"Inference scaling f laws: The limits of llm resampling with imperfect verifiers","venue":null,"work_id":"9f3b84e2-0249-41f2-a470-9f5fbdeec26b","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:cf59501e5ca6fcd72ed670fb455790aae92b479ec620c250ce8b1cf3ae89f772","observation_id":"8ea293d0-7f88-42ab-89f9-dceaf8face7a","resolution":{"observed_at":"2026-05-12T05:42:58.634717Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02419","last_updated":"2024-06-04T21:20:33Z","snapshot_observed_at":"2026-08-05T00:01:28.597728Z","submitted_at":"2024-03-04T19:12:48Z","title":"Are More LLM Calls All You Need? Towards Scaling Laws of Compound Inference Systems","version":2},"cited_work":{"arxiv_id":"2403.02419","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.02419","snapshot_observed_at":"2026-06-30T09:44:37.101148Z","title":"Are more llm calls all you need? Towards scaling laws of compound inference systems","venue":null,"work_id":"11a6e30d-1d15-49ba-9408-0f1386c2c043","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2403.02419","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:7fda41a85b2dc058e44067ea2a9085652b5e0e638c321065bbd353e8c068f173","observation_id":"6a29d052-7294-4fe4-9f35-4d8491d8d70f","resolution":{"observed_at":"2026-05-12T05:42:58.663859Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00752","last_updated":"2025-03-18T19:50:04Z","snapshot_observed_at":"2026-08-04T14:50:34.271833Z","submitted_at":"2024-10-01T14:47:05Z","title":"TestGenEval: A Real World Unit Test Generation and Test Completion Benchmark","version":2},"cited_work":{"arxiv_id":"2410.00752","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00752","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Testgeneval: A real world unit test generation and test completion benchmark","venue":null,"work_id":"08671ef6-f19e-4b6e-9109-c5a82c8f68ce","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2410.00752","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:0a91e3e04ccc562bcf0a1b3161ac3dd7b28fe07455bba79eef54dddfe218bbb2","observation_id":"8b3bcd12-303f-47a2-9af5-9897f9af9525","resolution":{"observed_at":"2026-05-12T05:42:58.684087Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12813","last_updated":"2023-03-08T23:41:49Z","snapshot_observed_at":"2026-08-06T18:27:41.688063Z","submitted_at":"2023-02-24T18:48:43Z","title":"Check Your Facts and Try Again: Improving Large Language Models with External Knowledge and Automated Feedback","version":3},"cited_work":{"arxiv_id":"2302.12813","doi":"10.48550/arxiv.2302.12813","metadata_source":"pith","pith_arxiv_id":"2302.12813","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Check Your Facts and Try Again: Improving Large Language Models with External Knowledge and Automated Feedback","venue":"cs.CL","work_id":"f3a52af9-6b21-4f22-aa91-8f5d2fd21255","year":2023},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2302.12813","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:3771e3d8752ff04fb41b7619c5e91c2cbbdac249fbb121e6024f5f06204ae99d","observation_id":"a514a91a-489a-40c0-8adb-29ee3ebcd8f3","resolution":{"observed_at":"2026-05-17T10:02:52.531251Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.01707","last_updated":"2021-06-02T16:04:04Z","snapshot_observed_at":"2026-07-06T10:20:13.545492Z","submitted_at":"2020-12-03T05:17:55Z","title":"Leveraging Abstract Meaning Representation for Knowledge Base Question Answering","version":2},"cited_work":{"arxiv_id":"2012.01707","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2012.01707","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ques- tion answering over knowledge bases by leveraging semantic parsing and neuro-symbolic reasoning","venue":null,"work_id":"df22e9d0-0574-4d8f-9da2-f249e0c2c23d","year":2012},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2012.01707","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:b75f77ad62f1307b2d51a5644fa4954ab3cb438cd5c14302a7ee5a6d864ec538","observation_id":"065f37fa-6838-478c-971b-b18d289bc565","resolution":{"observed_at":"2026-05-12T05:42:58.712681Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on llm-based multi-agent systems: workflow, infrastructure, and challenges.Vicinagearth, 1(1):9","venue":null,"work_id":"80ac260c-986d-4778-a3fc-6acec3707a10","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:67857c9f1708dcb648b701b44c687d4e5cc443f552e319f0f1c8db7f1ddd76c3","observation_id":"425dc28b-ecb6-411e-b9de-30d066d44d2d","resolution":{"observed_at":"2026-05-12T05:42:58.917941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-agent graph-attention communica- tion and teaming","venue":null,"work_id":"db6ca3f9-1e12-493f-bc38-5f52ac5700b9","year":2021},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:39508f48861bfa6da30bf1fe31df13475d0a60a52888eaaa23a2b88565280c9b","observation_id":"8181f267-f790-4557-bb92-af927ece9610","resolution":{"observed_at":"2026-05-12T05:42:58.922017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning attentional communication for multi-agent coopera- tion.Advances in neural information processing systems, 31","venue":null,"work_id":"04366490-c8e1-4e4e-9d3d-e84814b40ae6","year":2018},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:fd31f6ab6acef3d697d70c823ae317f7fc7f43baad4d5aa4e9d5fba88f62942d","observation_id":"ff5d198e-6fa2-489a-b506-c8765befbdba","resolution":{"observed_at":"2026-05-12T05:42:58.927959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.09755","last_updated":"2018-12-23T19:07:36Z","snapshot_observed_at":"2026-07-06T07:23:12.709369Z","submitted_at":"2018-12-23T19:07:36Z","title":"Learning when to Communicate at Scale in Multiagent Cooperative and Competitive Tasks","version":1},"cited_work":{"arxiv_id":"1812.09755","doi":null,"metadata_source":"pith","pith_arxiv_id":"1812.09755","snapshot_observed_at":"2026-07-04T04:39:35.080773Z","title":"Learning when to Communicate at Scale in Multiagent Cooperative and Competitive Tasks","venue":"cs.LG","work_id":"b084ed7c-9c3d-4261-af12-a832b0286f46","year":2018},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/1812.09755","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:bd7f4e53ba4b5dbaa66ff447abdfd109f8e6f17053ba0dcc431d46c0697db7be","observation_id":"1bfa97c9-0bc1-4a63-91a0-98b83f967c97","resolution":{"observed_at":"2026-05-12T05:42:58.717697Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T10:33:39.725960Z","title":"The surprising effectiveness of ppo in cooperative multi-agent games.Advances in Neural Information Processing Systems, 35:24611–24624","venue":null,"work_id":"cc3118aa-275a-48ae-b5fe-6d10cba4ff2f","year":2022},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:14c754da17d9d8f5df73fe85e90f43f3a4227f2c1a2f5fb3afceed4847ca1ae2","observation_id":"7b5bb5fc-070c-4cc4-93e7-ad42e42c0134","resolution":{"observed_at":"2026-05-12T05:42:58.939798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03869","last_updated":"2024-10-02T14:52:13Z","snapshot_observed_at":"2026-08-05T16:17:37.838936Z","submitted_at":"2024-04-05T03:02:57Z","title":"Heterogeneous Multi-Agent Reinforcement Learning for Zero-Shot Scalable Collaboration","version":2},"cited_work":{"arxiv_id":"2404.03869","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.03869","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Heterogeneous multi-agent reinforce- ment learning for zero-shot scalable collaboration","venue":null,"work_id":"164dbf34-e989-4bc0-8a56-501038a4a9b1","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2404.03869","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:b601e1ff43928e7dd6989e2778816c4fda8dcef6f20cf2e9998d1c29b43a71dd","observation_id":"8e506054-92e5-4d67-8520-a2602e211a5f","resolution":{"observed_at":"2026-05-12T05:42:58.724310Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08115","last_updated":"2025-02-18T12:50:00Z","snapshot_observed_at":"2026-08-06T21:09:09.996403Z","submitted_at":"2024-10-10T17:00:06Z","title":"Optima: Optimizing Effectiveness and Efficiency for LLM-Based Multi-Agent System","version":2},"cited_work":{"arxiv_id":"2410.08115","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.08115","snapshot_observed_at":"2026-07-03T20:48:56.444480Z","title":"Optima: Optimizing effectiveness and efficiency for llm-based multi-agent system","venue":null,"work_id":"a9a87d1b-54c2-43f6-870f-a14c9746b16d","year":2025},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2410.08115","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:96efbd25dc279e61046182ef41fce172dec999c421642cbdd702fa8db10ddc0c","observation_id":"08cbb6b2-20f1-4d51-8a9b-6f5bd8d8facb","resolution":{"observed_at":"2026-05-12T05:42:58.737405Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Uncertainty, action, and interaction: In pursuit of mixed-initiative computing","venue":null,"work_id":"fb97e0da-4b9d-45ff-8550-0dd9f90dc79e","year":1999},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:668bd016e44cca860dc2551e494955089bd34df5fe6ff12da33c4d38b143fe12","observation_id":"6729f59f-1ba2-4517-bf79-f55a94b980eb","resolution":{"observed_at":"2026-05-12T05:42:58.961798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Servicenow: From startup to world’s most innovative company.IUP Journal of Entrepreneurship Development, 20(1)","venue":null,"work_id":"6399a424-bf2a-4be3-a82b-d114bce49996","year":2023},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:e273f5ab40095cf4e7ea99e39e550442dfeadd463fe43884d8c28af2f57fba75","observation_id":"1ba11e89-ae6a-46d3-bf8b-0bc6279e827c","resolution":{"observed_at":"2026-05-12T05:42:58.965040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19255","last_updated":"2024-07-02T03:46:03Z","snapshot_observed_at":"2026-08-06T12:10:50.595602Z","submitted_at":"2024-02-29T15:26:14Z","title":"GSM-Plus: A Comprehensive Benchmark for Evaluating the Robustness of LLMs as Mathematical Problem Solvers","version":2},"cited_work":{"arxiv_id":"2402.19255","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.19255","snapshot_observed_at":"2026-07-03T22:39:01.102254Z","title":"Li, W.; and Li, Y","venue":null,"work_id":"e9445936-9002-4497-ad10-984bf294269f","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2402.19255","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:6ac4f725535f2c356ee51d1b58d204021882ae1efb9ab83cbd937bb0fef86224","observation_id":"ac0af52a-9b08-4286-9cec-ebf9de1c221a","resolution":{"observed_at":"2026-05-12T05:42:58.742230Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:0837d152fa246054ca3617fe6d99e3e6d3d873264718959f5b2acd6ade119179","observation_id":"6720efe1-1d37-4156-bf89-bf0de63a5598","resolution":{"observed_at":"2026-05-12T05:42:58.748112Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":"2409.12186","doi":"10.48550/arxiv.2409.12186","metadata_source":"pith","pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-Coder Technical Report","venue":"cs.CL","work_id":"09ba463d-6377-4017-9801-444ffb94b056","year":2024},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:fe3866c88c31ac4505f9bd286839962bd5fee6533fea6723a71dbef98641a1ea","observation_id":"df0b3754-20fb-489f-9b5f-3a109aa88515","resolution":{"observed_at":"2026-05-12T05:42:58.754585Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:18:55.772185+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:18:55.772185+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-07-06T16:10:07.931347Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":"2308.12950","doi":"10.48550/arxiv.2308.12950","metadata_source":"pith","pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Code Llama: Open Foundation Models for Code","venue":"cs.CL","work_id":"e73bffa4-7620-47ac-9327-259a60db52ca","year":2023},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:5da9333121414842b6a8a4c5c43ba826dfc467212fca309ec770b4d4c23abd18","observation_id":"38b5d91c-c422-41b9-8e68-de062576f625","resolution":{"observed_at":"2026-05-12T05:42:58.758845Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-09T08:48:36.742994+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T08:48:36.742994+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1978aeda-1145-4eb0-af05-dba779e72dfb","year":null},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:c02c8b567c2fa597bf7645899e5b4055ace107555ce205fd736f5842b16225be","observation_id":"79e2c177-7a48-4813-8e21-9a45623028df","resolution":{"observed_at":"2026-05-12T05:42:58.995357Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Magentic-One","venue":null,"work_id":"66f113a8-3533-4ca9-92fc-7b4ec5292248","year":null},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:5fc8b5d977de040c71b318d5c444de52256a466cd46c9d89e87837d432996511","observation_id":"1249f12d-340e-4300-a13f-f1679988d943","resolution":{"observed_at":"2026-05-12T05:42:59.000455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OpenManus","venue":null,"work_id":"a880ce11-4451-420b-8cf3-b8769ea2126a","year":null},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:3ec54cb93734fdcdb0b2a8ed95daba259678dfb1c24fc94293639621945584f4","observation_id":"5834ff44-db98-4b3f-909c-faed532e7802","resolution":{"observed_at":"2026-05-12T05:42:59.021261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Communicative Dehallucination","venue":null,"work_id":"dcf007e0-c0b1-499d-90c1-2eff90fb9c41","year":null},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:c39c4121f4a524a267d7fa5904c9f93e523c992bc084f73e4724584b61337b71","observation_id":"bfddfb73-cca6-4fc2-8953-62a9999b0b2f","resolution":{"observed_at":"2026-05-12T05:42:59.033912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Interagent Misalignment 3","venue":null,"work_id":"51f6a232-c92e-4bc8-8e8d-65f45198f911","year":null},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:f9502754f87c48cab60fb0074f493b834393a3742100c7ccdb95823feff6f968","observation_id":"2d3aaa6a-8b23-41b4-8e29-a4a72a94d32d","resolution":{"observed_at":"2026-05-12T05:42:59.038595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Write me a two-player chess game playable in the terminal","venue":null,"work_id":"46148058-e6ee-48d2-ae6b-c4fbfd4984b1","year":null},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:681e94a289b82aea1be5a157c1f120693970b21da5da3ad940a0e449b8fc2643","observation_id":"843d931c-b7bb-42a8-a625-da2ba3fa2e8f","resolution":{"observed_at":"2026-05-12T05:42:59.048118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Interagent Misalignment 3","venue":null,"work_id":"f774fcfe-7a8c-4001-ba16-5e67b8efda2e","year":null},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:389684d519fa24664fcecc0a2787a24f62a5107bd57f44f40a85ef8e7b585d13","observation_id":"55f9954a-e155-4d10-9a1f-ab758df925a4","resolution":{"observed_at":"2026-05-12T05:42:59.059894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Interagent Misalignment 3","venue":null,"work_id":"72e000d8-48a9-49ff-9220-97a8b8ca16c5","year":null},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:81974b1ca7b49462d0733c2cd583ed13c4038ffe14338a82122d8a738dd95fa2","observation_id":"aeeb615e-31ef-49d1-bf18-d172a61cb599","resolution":{"observed_at":"2026-05-12T05:42:59.079965Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"efa4fc40-6b5f-4408-9aed-c33734620aed","year":null},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:2369dd50cbe614408b0e76c8dfa441dc138c3a9911eba513e42bc791055edd40","observation_id":"7a4deb5a-8ced-4fd1-bfdd-63c1409c9e3c","resolution":{"observed_at":"2026-05-12T05:42:59.094741Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9e97d38b-c733-4c86-8bb7-257e939ac0cb","year":null},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:2ed082d19761e9bbc080d82e72a5d576cd5ea3285f225ded54187fba5b33f30e","observation_id":"9fad2d7a-ac04-4e00-bd21-2cf70284f342","resolution":{"observed_at":"2026-05-12T05:42:59.103748Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5d2a3021-6dbc-468f-9b58-2939ef40488b","year":null},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:cea231be0e88f568b3222d74ccea55cf25008df8c12545cbf86977aaac54a78f","observation_id":"6d84246a-b26f-480e-9dc8-6a96ec786220","resolution":{"observed_at":"2026-05-12T05:42:59.110337Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"If the result is invalid or unexpected, please correct your query or reasoning","venue":null,"work_id":"ccc2060f-a812-464a-aca3-a6f1889bf1d6","year":null},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:2e45951017217d69667c0218f915b765ab416aaa184ec6716aa5cab67aeec754","observation_id":"5fda7fb9-e911-4eb4-bcf7-ba3e0c22616d","resolution":{"observed_at":"2026-05-12T05:42:59.126740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Use fractions or radical forms instead of decimal numbers","venue":null,"work_id":"e8f0b6e1-56e1-4722-854d-c2d83f3719e7","year":null},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:ad5e78fbc6b962b2bbd4650498d9e1a26d498fcd9e2e42c89ce4476fefb77d2e","observation_id":"0ed24cf8-7680-4fb7-9c24-21090756eadb","resolution":{"observed_at":"2026-05-12T05:42:59.153749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"94c796d0-ad76-47cf-bc85-9d335fb1fc5d","year":null},"citing_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-12T05:42:57.561468Z"},"links":{"citing_paper":"/paper/2503.13657"},"observation_digest":"sha256:2917a2c94664e342663878071f160a20a331f79ad787aaf3a19a2cf3d6d54fe3","observation_id":"c92d19d2-6cc9-4fe6-8493-13a9cd9ccc09","resolution":{"observed_at":"2026-05-12T05:42:59.157736Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":1,"metadata_mismatch":15,"parse_uncertain":0,"unresolved":6,"verified_exact":38,"verified_fuzzy":40},"total_outbound_references":123},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 100 of 123 outbound references and 100 inbound Pith citation observations for arXiv:2503.13657."}