{"as_of":"2026-08-14T01:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d87811c1bbe3858598eedecdec031496db42ee3f3cdc32f99741e37ab44c75b9","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T16:55:25.086245Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05263/citation-record","integrity":"/paper/2608.05263/integrity","json":"/paper/2608.05263/citation-record.json","paper":"/paper/2608.05263"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:55:25.461818Z","title":null,"venue":null,"work_id":"a99a779c-a7fd-44e7-b51f-9c9d40c4305e","year":2026},"citing_paper":{"arxiv_id":"2608.05263","last_updated":"2026-08-05T17:27:15Z","snapshot_observed_at":"2026-08-13T22:51:34.474756Z","submitted_at":"2026-08-05T17:27:15Z","title":"OrchestraBench: Evaluating Multi-Agent Orchestration Failure Modes, Recovery, and Decomposition Quality","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T16:55:25.049359Z"},"links":{"citing_paper":"/paper/2608.05263"},"observation_digest":"sha256:6491f34bbaeb4b06717772d02c8262b33793c8ea6447088043ab83788a92d5f4","observation_id":"bda7e281-e311-4fc6-ac00-c0d94ddb9991","resolution":{"observed_at":"2026-08-08T16:55:25.464905Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13657","last_updated":"2025-10-26T23:25:18Z","snapshot_observed_at":"2026-08-12T20:41:24.869212Z","submitted_at":"2025-03-17T19:04:38Z","title":"Why Do Multi-Agent LLM Systems Fail?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13657","snapshot_observed_at":"2026-08-08T16:55:25.053010Z","title":"Pan, Shuyi Yang, Lakshya A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05263","last_updated":"2026-08-05T17:27:15Z","snapshot_observed_at":"2026-08-13T22:51:34.474756Z","submitted_at":"2026-08-05T17:27:15Z","title":"OrchestraBench: Evaluating Multi-Agent Orchestration Failure Modes, Recovery, and Decomposition Quality","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T16:55:25.053010Z"},"links":{"cited_paper":"/paper/2503.13657","citing_paper":"/paper/2608.05263"},"observation_digest":"sha256:9bb087742556c2daeb692aa2cde332a23a18f7e6480604f94946abf77b8e128e","observation_id":"4da9c864-5e82-4517-84e9-5e7a6af432f4","resolution":{"observed_at":"2026-08-08T16:55:25.053010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.22708","last_updated":"2026-04-24T16:40:44Z","snapshot_observed_at":"2026-08-01T02:48:11.813360Z","submitted_at":"2026-04-24T16:40:44Z","title":"Seeing the Whole Elephant: A Benchmark for Failure Attribution in LLM-based Multi-Agent Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.22708","snapshot_observed_at":"2026-08-08T16:55:25.055968Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05263","last_updated":"2026-08-05T17:27:15Z","snapshot_observed_at":"2026-08-13T22:51:34.474756Z","submitted_at":"2026-08-05T17:27:15Z","title":"OrchestraBench: Evaluating Multi-Agent Orchestration Failure Modes, Recovery, and Decomposition Quality","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T16:55:25.055968Z"},"links":{"cited_paper":"/paper/2604.22708","citing_paper":"/paper/2608.05263"},"observation_digest":"sha256:48aba395b3a884bcb91a08a534164b9ca787aba73c7d35ed6048159a5ad13282","observation_id":"98ce1601-51f6-4558-869a-4bb14d0b31fc","resolution":{"observed_at":"2026-08-08T16:55:25.055968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:55:25.058736Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05263","last_updated":"2026-08-05T17:27:15Z","snapshot_observed_at":"2026-08-13T22:51:34.474756Z","submitted_at":"2026-08-05T17:27:15Z","title":"OrchestraBench: Evaluating Multi-Agent Orchestration Failure Modes, Recovery, and Decomposition Quality","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T16:55:25.058736Z"},"links":{"citing_paper":"/paper/2608.05263"},"observation_digest":"sha256:9e2d76cdd9886013e1f1cb6940418c82b3cb4cb94c040ede1db10f747864490f","observation_id":"8c0d5811-648d-4f41-9cbb-e0bc95a187ff","resolution":{"observed_at":"2026-08-08T16:55:25.058736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-08-12T14:56:35.025839Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-08T16:55:25.061431Z","title":"Jimenez, John Yang, Alexander Wettig, Shunyu Yao, Kexin Pei, Ofir Press, and Karthik Narasimhan","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05263","last_updated":"2026-08-05T17:27:15Z","snapshot_observed_at":"2026-08-13T22:51:34.474756Z","submitted_at":"2026-08-05T17:27:15Z","title":"OrchestraBench: Evaluating Multi-Agent Orchestration Failure Modes, Recovery, and Decomposition Quality","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T16:55:25.061431Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2608.05263"},"observation_digest":"sha256:0d79ae26891baff932e8db5324a8e42399f37c219079836a19f4c376fa6a2891","observation_id":"a0fa45f8-9519-47b3-8a03-363bfd6e0a9e","resolution":{"observed_at":"2026-08-08T16:55:25.061431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:55:25.064300Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05263","last_updated":"2026-08-05T17:27:15Z","snapshot_observed_at":"2026-08-13T22:51:34.474756Z","submitted_at":"2026-08-05T17:27:15Z","title":"OrchestraBench: Evaluating Multi-Agent Orchestration Failure Modes, Recovery, and Decomposition Quality","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T16:55:25.064300Z"},"links":{"citing_paper":"/paper/2608.05263"},"observation_digest":"sha256:96e913979f912a336417a1778570f2ea110734f842ef55a2cd1fc0035eb637d7","observation_id":"d4d14260-fb19-4726-9c64-857b0e70a7de","resolution":{"observed_at":"2026-08-08T16:55:25.064300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03688","last_updated":"2025-10-04T03:54:18Z","snapshot_observed_at":"2026-08-13T14:09:17.964744Z","submitted_at":"2023-08-07T16:08:11Z","title":"AgentBench: Evaluating LLMs as Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03688","snapshot_observed_at":"2026-08-08T16:55:25.067711Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05263","last_updated":"2026-08-05T17:27:15Z","snapshot_observed_at":"2026-08-13T22:51:34.474756Z","submitted_at":"2026-08-05T17:27:15Z","title":"OrchestraBench: Evaluating Multi-Agent Orchestration Failure Modes, Recovery, and Decomposition Quality","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T16:55:25.067711Z"},"links":{"cited_paper":"/paper/2308.03688","citing_paper":"/paper/2608.05263"},"observation_digest":"sha256:091eaa07c79435ddf816b3e66cbc1ebd5659efc07be0a4ee8ed191e40dd7238c","observation_id":"d768e3fc-1ceb-4ecf-a552-de120e499892","resolution":{"observed_at":"2026-08-08T16:55:25.067711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:55:25.070879Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05263","last_updated":"2026-08-05T17:27:15Z","snapshot_observed_at":"2026-08-13T22:51:34.474756Z","submitted_at":"2026-08-05T17:27:15Z","title":"OrchestraBench: Evaluating Multi-Agent Orchestration Failure Modes, Recovery, and Decomposition Quality","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T16:55:25.070879Z"},"links":{"citing_paper":"/paper/2608.05263"},"observation_digest":"sha256:79591e80234ae41cbc439c3a47c64b8e098286abf66517912c5a9f31cf486228","observation_id":"afb39c2b-fed8-4bc4-b8e0-aa8a14c79318","resolution":{"observed_at":"2026-08-08T16:55:25.070879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09124","last_updated":"2025-08-12T17:53:03Z","snapshot_observed_at":"2026-08-06T17:04:47.204008Z","submitted_at":"2025-08-12T17:53:03Z","title":"OdysseyBench: Evaluating LLM Agents on Long-Horizon Complex Office Application Workflows","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.09124","snapshot_observed_at":"2026-08-08T16:55:25.073757Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05263","last_updated":"2026-08-05T17:27:15Z","snapshot_observed_at":"2026-08-13T22:51:34.474756Z","submitted_at":"2026-08-05T17:27:15Z","title":"OrchestraBench: Evaluating Multi-Agent Orchestration Failure Modes, Recovery, and Decomposition Quality","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T16:55:25.073757Z"},"links":{"cited_paper":"/paper/2508.09124","citing_paper":"/paper/2608.05263"},"observation_digest":"sha256:efa885df22b355786bc4bf0b24371c75a2a203c0c490e89d3f213aa1d9d756ab","observation_id":"ba1c042e-869e-4601-8b0d-3df27d192725","resolution":{"observed_at":"2026-08-08T16:55:25.073757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.04474","last_updated":"2026-05-11T15:41:00Z","snapshot_observed_at":"2026-08-11T17:09:52.868826Z","submitted_at":"2026-03-04T11:45:27Z","title":"From Spark to Fire: Modeling and Mitigating Error Cascades in LLM-Based Multi-Agent Collaboration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.04474","snapshot_observed_at":"2026-08-08T16:55:25.076877Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05263","last_updated":"2026-08-05T17:27:15Z","snapshot_observed_at":"2026-08-13T22:51:34.474756Z","submitted_at":"2026-08-05T17:27:15Z","title":"OrchestraBench: Evaluating Multi-Agent Orchestration Failure Modes, Recovery, and Decomposition Quality","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T16:55:25.076877Z"},"links":{"cited_paper":"/paper/2603.04474","citing_paper":"/paper/2608.05263"},"observation_digest":"sha256:b99a0d35f511c17e23200391e915b11afab8a7c89d35186926b9005515b32fe5","observation_id":"f98b9881-50a1-4c5f-8ee8-825bba1b55fa","resolution":{"observed_at":"2026-08-08T16:55:25.076877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:55:25.080128Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05263","last_updated":"2026-08-05T17:27:15Z","snapshot_observed_at":"2026-08-13T22:51:34.474756Z","submitted_at":"2026-08-05T17:27:15Z","title":"OrchestraBench: Evaluating Multi-Agent Orchestration Failure Modes, Recovery, and Decomposition Quality","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T16:55:25.080128Z"},"links":{"citing_paper":"/paper/2608.05263"},"observation_digest":"sha256:0cf5cc39a86a7b32c10699614e1fadada52927dd7c83542acbe173ee6c068829","observation_id":"0e07f305-0cfa-4ab7-a867-86b91fa84f4c","resolution":{"observed_at":"2026-08-08T16:55:25.080128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:55:25.451231Z","title":null,"venue":null,"work_id":"266d28c4-6106-4d27-a0e6-bc346c718404","year":null},"citing_paper":{"arxiv_id":"2608.05263","last_updated":"2026-08-05T17:27:15Z","snapshot_observed_at":"2026-08-13T22:51:34.474756Z","submitted_at":"2026-08-05T17:27:15Z","title":"OrchestraBench: Evaluating Multi-Agent Orchestration Failure Modes, Recovery, and Decomposition Quality","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T16:55:25.082955Z"},"links":{"citing_paper":"/paper/2608.05263"},"observation_digest":"sha256:a1be83826f4d24071afeeec72ecbe2d484ec135f6be8fc7f2fea4b9dcdc90da4","observation_id":"1b1a4bc4-5c4a-4cf5-bfd2-d7320037acf2","resolution":{"observed_at":"2026-08-08T16:55:25.455420Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00212","last_updated":"2025-06-02T03:25:55Z","snapshot_observed_at":"2026-08-07T15:57:31.436553Z","submitted_at":"2025-04-30T23:09:44Z","title":"Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00212","snapshot_observed_at":"2026-08-08T16:55:25.086245Z","title":"InProceedings of the 42nd International Conference on Machine Learning (ICML), Spotlight","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05263","last_updated":"2026-08-05T17:27:15Z","snapshot_observed_at":"2026-08-13T22:51:34.474756Z","submitted_at":"2026-08-05T17:27:15Z","title":"OrchestraBench: Evaluating Multi-Agent Orchestration Failure Modes, Recovery, and Decomposition Quality","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-08T16:55:25.086245Z"},"links":{"cited_paper":"/paper/2505.00212","citing_paper":"/paper/2608.05263"},"observation_digest":"sha256:0c97eae56d1a851fc0aa50a9d96b1af206033b0fca39d22039cd5a5e8ae336af","observation_id":"3f7cdcfb-68ca-4dbf-9693-bebea510f99b","resolution":{"observed_at":"2026-08-08T16:55:25.086245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.05263","last_updated":"2026-08-05T17:27:15Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-13T22:51:34.474756Z","submitted_at":"2026-08-05T17:27:15Z","title":"OrchestraBench: Evaluating Multi-Agent Orchestration Failure Modes, Recovery, and Decomposition Quality"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 0 inbound Pith citation observations for arXiv:2608.05263."}