{"as_of":"2026-08-19T01:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:30b52aa59d03292fa77435c6cac21a05c9dc488a240eccff9a4b0569658ef257","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T04:20:02.722108Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T00:41:10.574009Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-12T00:41:10.746614Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.27288","snapshot_observed_at":"2026-07-12T02:29:58.886380Z","title":"When does combining language models help? a co-failure ceiling on routing, voting, and mixture-of-agents across 67 frontier models,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03436","last_updated":"2026-07-07T05:35:41Z","snapshot_observed_at":"2026-08-13T02:54:32.190736Z","submitted_at":"2026-07-03T15:49:40Z","title":"How Much of the Routing Gap Is Real? Decomposing the Router-to-Oracle Gap into Reproducible Specialist Advantage and Single-Draw Label Noise","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-12T02:29:58.886380Z"},"links":{"cited_paper":"/paper/2606.27288","citing_paper":"/paper/2607.03436"},"observation_digest":"sha256:23f1d7b559876be9f22357c10d4c507f6c0d0ba3c7b99a3b8890102090011c6b","observation_id":"ea57aa22-70df-40c7-90f3-f3e5ff7bf5e1","resolution":{"observed_at":"2026-07-12T02:29:58.886380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.27288","snapshot_observed_at":"2026-08-01T09:29:48.309226Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.20768","last_updated":"2026-07-22T22:34:57Z","snapshot_observed_at":"2026-08-15T17:38:19.627117Z","submitted_at":"2026-07-22T22:34:57Z","title":"Are Diversity Metrics Measuring Diversity? A Capability-Controlled Audit of Majority-Vote Gain in LLM Ensembles","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-01T09:29:48.309226Z"},"links":{"cited_paper":"/paper/2606.27288","citing_paper":"/paper/2607.20768"},"observation_digest":"sha256:1aae0a8e0dc27c75e1e1b670c4ba311fb608d3c4514fac5d0968d462f5fac669","observation_id":"894c4f17-0c41-42e5-842e-2c4aed807acf","resolution":{"observed_at":"2026-08-01T09:29:48.309226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"cited_work":{"arxiv_id":"2606.27288","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.27288","snapshot_observed_at":"2026-08-12T00:41:10.746614Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","venue":"cs.AI","work_id":"c7d500ea-e9da-4aba-b7e3-256599240666","year":2026},"citing_paper":{"arxiv_id":"2608.08002","last_updated":"2026-08-08T08:28:55Z","snapshot_observed_at":"2026-08-15T17:24:10.825832Z","submitted_at":"2026-08-08T08:28:55Z","title":"Evaluator Ensembles Under Reward Hacking: Covariance Geometry and Finite-Search Guarantees","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-12T00:41:10.574009Z"},"links":{"cited_paper":"/paper/2606.27288","citing_paper":"/paper/2608.08002"},"observation_digest":"sha256:36942d3e2f667d23bcb0443840d0ced69d607df6f6dc2c160be0ae4fec2e889c","observation_id":"b3470af0-420f-431f-890c-f6967526c631","resolution":{"observed_at":"2026-08-12T00:41:10.753254Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2606.27288/citation-record","integrity":"/paper/2606.27288/integrity","json":"/paper/2606.27288/citation-record.json","paper":"/paper/2606.27288"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":"Tsitsiklis.Introduction to Linear Optimization","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:90d7674fcd913b3ff29c9779c47b02c27a40100087ce18ba8c906353f7de236d","observation_id":"29adf54a-3eaf-4138-9d50-dda2e5150d05","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05176","last_updated":"2023-05-09T05:11:02Z","snapshot_observed_at":"2026-08-10T11:59:11.481480Z","submitted_at":"2023-05-09T05:11:02Z","title":"FrugalGPT: How to Use Large Language Models While Reducing Cost and Improving Performance","version":1},"cited_work":{"arxiv_id":"2305.05176","doi":"10.48550/arxiv.2305.05176","metadata_source":"pith","pith_arxiv_id":"2305.05176","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"FrugalGPT: How to Use Large Language Models While Reducing Cost and Improving Performance","venue":"cs.LG","work_id":"5c567414-35de-4373-ae7a-1790da594e8d","year":2023},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"cited_paper":"/paper/2305.05176","citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:adcb29fbcf6c7450b8e1d9c227b3b249f02845f34abd13157caa59e5749b0acd","observation_id":"2dc3ce6b-f435-4b40-9f5f-f0a136238bab","resolution":{"observed_at":"2026-07-04T14:19:53.605412Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-15T07:08:14.020381+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-15T07:08:14.020381+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10347","last_updated":"2025-05-22T12:34:14Z","snapshot_observed_at":"2026-08-16T13:09:41.096467Z","submitted_at":"2024-10-14T10:00:49Z","title":"A Unified Approach to Routing and Cascading for LLMs","version":3},"cited_work":{"arxiv_id":"2410.10347","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.10347","snapshot_observed_at":"2026-07-04T20:50:12.595650Z","title":"A unified approach to routing and cascad- ing for llms.arXiv preprint arXiv:2410.10347","venue":null,"work_id":"2ea451d7-a030-479e-88d9-43b0e9d884d5","year":2024},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"cited_paper":"/paper/2410.10347","citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:ed537eb1f709942da7067378384590ced63f24ebafab7b64538212810a6fb15b","observation_id":"a0e6b167-2495-4d6e-b59d-072321e1e509","resolution":{"observed_at":"2026-07-04T14:19:53.608705Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:3fe9addc0d5fb8ca00ba348eb0282a343519597279a1537774d2a234ba12d460","observation_id":"e0a5ee80-656a-4a0b-bb88-22f96aa57379","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":"Dixit and Robert S","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:aade372025b32f07eb600d1744ee2f570ae84842b6ef443984eb6faeadfe46d3","observation_id":"b7c2c181-8a7f-45fa-8658-bc72922e1a27","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":"The devil is in the tails: actuarial mathematics and the subprime mortgage crisis.ASTIN Bulletin, 40(1):1–33, 2010","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:dd63ce07f9d3369aa97017cf38ce710852ce50420a99672f5a0db057ad04cbe4","observation_id":"5ea4d041-c992-4d89-a9f4-e5a670fef573","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":"McNeil, and Daniel Straumann","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:1958c1c99cef6c65c327a39001b06aa8dc45de2ec9beddcb5e15ee3ae09ec158","observation_id":"4a9f4280-bdf1-420d-9993-cf5973b101a3","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.13359","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T19:40:07.165453Z","title":"Cost-of-Pass: An economic framework for evaluating language models","venue":null,"work_id":"fbef61fd-442f-446b-b168-68fb1604f9b4","year":2025},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:4be2217f584b19cd3a0e2209a618e40e6a47eb6e5dce98342757dffe038c081d","observation_id":"fba27e13-c8e2-49c1-add2-d84227863693","resolution":{"observed_at":"2026-07-04T14:19:53.630618Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":"Representation of multivariate bernoulli distributions with a given set of specified moments.Journal of Multivariate Analysis, 168:290–303, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:6a003750e56defa87ac72b5a31cd1c1fcccad2d3fa131e1963ae1d0353dd599b","observation_id":"6b3e4cd1-9d6c-4519-afba-38479407a4e1","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":"Selective classification for deep neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:1331418d9d0dc3d4c3af7ea96f8c416f3a86b34fecb05eee4e52062241ba374d","observation_id":"d6d2f1b2-fd34-4ae9-a1cc-fe6000bea71d","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":null,"venue":null,"work_id":null,"year":1966},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:3e8bb21514deec484316a877206dcb71a560b3da84387769d3228ac6149c70b3","observation_id":"af26074b-a7e9-40ab-b757-3cd2225a0ad8","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12031","last_updated":"2024-03-28T17:56:28Z","snapshot_observed_at":"2026-08-16T16:38:21.205977Z","submitted_at":"2024-03-18T17:59:04Z","title":"RouterBench: A Benchmark for Multi-LLM Routing System","version":2},"cited_work":{"arxiv_id":"2403.12031","doi":"10.48550/arxiv.2403.12031","metadata_source":"pith","pith_arxiv_id":"2403.12031","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RouterBench: A Benchmark for Multi-LLM Routing System","venue":"cs.LG","work_id":"ab0c1f58-f46a-4885-8afb-6a26e45608fb","year":2024},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"cited_paper":"/paper/2403.12031","citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:54cc7985e1aa78087f6aafa541472ec6686474e58aea7b74fccc038dd7994d66","observation_id":"87e67d21-b3bf-4fc0-9a65-eeb7ff031ddf","resolution":{"observed_at":"2026-07-04T14:19:53.617760Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-05-25T19:24:14.251945+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T19:24:14.251945+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02561","last_updated":"2023-06-30T21:39:54Z","snapshot_observed_at":"2026-08-18T18:36:22.935192Z","submitted_at":"2023-06-05T03:32:26Z","title":"LLM-Blender: Ensembling Large Language Models with Pairwise Ranking and Generative Fusion","version":3},"cited_work":{"arxiv_id":"2306.02561","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.02561","snapshot_observed_at":"2026-07-04T19:50:11.019242Z","title":"Llm-blender: Ensembling large language models with pairwise ranking and generative fusion","venue":null,"work_id":"1accd5f4-8546-41b7-a132-6f6dde8df864","year":2023},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"cited_paper":"/paper/2306.02561","citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:ee04df1aee103ab03f5fa64066b671e797290cac64f8750f623737e4a5eae73f","observation_id":"e46e67cd-140b-4bef-8264-3858b6cb8fa1","resolution":{"observed_at":"2026-07-04T14:19:53.623152Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02764","last_updated":"2024-01-23T16:01:02Z","snapshot_observed_at":"2026-08-16T15:18:21.215310Z","submitted_at":"2023-07-06T04:13:57Z","title":"When Does Confidence-Based Cascade Deferral Suffice?","version":2},"cited_work":{"arxiv_id":"2307.02764","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.02764","snapshot_observed_at":"2026-07-04T14:19:53.613142Z","title":"When does confidence-based cascade deferral suffice?","venue":null,"work_id":"6db1b869-729d-4e50-b443-42bcb5067215","year":2023},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"cited_paper":"/paper/2307.02764","citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:0949e000eb4618a63f9ec7ad77787b3229f2f9da5483541f1b9eae8e4c8274e8","observation_id":"76cc74b8-4988-45d5-9f6a-ae6eda2d43ef","resolution":{"observed_at":"2026-07-04T14:19:53.614862Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07962","last_updated":"2025-06-09T17:37:18Z","snapshot_observed_at":"2026-08-16T06:04:54.132074Z","submitted_at":"2025-06-09T17:37:18Z","title":"Correlated Errors in Large Language Models","version":1},"cited_work":{"arxiv_id":"2506.07962","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07962","snapshot_observed_at":"2026-07-04T14:19:53.634812Z","title":"Correlated Errors in Large Language Models","venue":null,"work_id":"89336b1c-9c72-4a13-a0cb-8893b50d1a47","year":2025},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"cited_paper":"/paper/2506.07962","citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:74085118e81594afba4853ee04de38f3e45db693892393f7adf9c26b89f28081","observation_id":"93dd0bbe-ba52-4994-86c4-7581c0363fd6","resolution":{"observed_at":"2026-07-04T14:19:53.636552Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":"Algorithmic monoculture and social welfare.Proceedings of the National Academy of Sciences, 118(22):e2018340118, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:f2d15293b4aa9554e6ee7de3af513b9e843b38aa6aef807eab759c4e9a132245","observation_id":"b194c67a-da44-4ec2-b303-bc6d1b61ea71","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":"Competition when consumers have switching costs.The Review of Economic Studies, 62(4):515–539, 1995","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:b0559d28cf46409aacd2e704d6b14d519f9429ccc54331fc36807026eb52b114","observation_id":"b5500eae-2104-4ef6-b980-6eb5492a9f77","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":"Neural network ensembles, cross validation, and active learning","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:2e662c1925a4d50cff7ad12668eae4a442f5d3e3bd4776a23b6301c52a9001e1","observation_id":"14b14b7c-f165-468f-9c7c-1860a180d49f","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":"Kuncheva.Combining Pattern Classifiers: Methods and Algorithms","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:ed9d201cc0358e5ba68d760bb0885cc0ca10b4be0fd6eb977c8165d7d9d89ab0","observation_id":"992fb59f-d57e-4117-aa01-a5ffb10229b4","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":"Kuncheva and Christopher J","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:88401ad05241f51c47fd686a30ea7006b1dfd31cfa2725dd8d4848678ea802e7","observation_id":"856a3bd3-8fc1-4599-a38b-26179db0b208","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":"Kuncheva, Christopher J","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:31e86470714a043b8500bbaa8f5a75237347f13d0cc729bec9c5d979caaf7194","observation_id":"920f41c9-796e-4293-bc94-69f7de978bd8","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:d0144b075625f6b604ef932ec5b9260082cc5d200310b47e5d50e904e54d9cf8","observation_id":"626256e9-dcd7-4660-aa07-1eaf46bc3228","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05120","last_updated":"2024-10-11T09:38:40Z","snapshot_observed_at":"2026-08-18T10:10:17.969034Z","submitted_at":"2024-02-03T05:55:24Z","title":"More Agents Is All You Need","version":2},"cited_work":{"arxiv_id":"2402.05120","doi":"10.48550/arxiv.2402.05120","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05120","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"More agents is all you need","venue":"arXiv (Cornell University)","work_id":"3bf5aa60-0441-4df2-96b0-850dc92214bd","year":2024},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"cited_paper":"/paper/2402.05120","citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:1bd87e3ca7c401721a8b779fc2906d15f828a117926c680ff2aba71c1ad7bd4d","observation_id":"357129bc-5886-4d02-a8af-e471df4bed69","resolution":{"observed_at":"2026-07-04T14:19:53.627458Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-14T04:50:30.127326Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":"2502.00674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-07-09T02:35:53.862220Z","title":"Rethinking mixture-of-agents: Is mixing different large language models beneficial?","venue":"cs.CL","work_id":"c6745a0f-feed-481a-8c8e-4986a80b8afe","year":2025},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:2e5189a0c0eb04dbee278d3a3abf915f766cf7c519a3054845cac7a050588d3e","observation_id":"5b5ad1f4-9ad7-4094-9b23-956c4ad5419d","resolution":{"observed_at":"2026-07-04T14:19:53.611757Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12963","last_updated":"2025-01-19T15:59:56Z","snapshot_observed_at":"2026-08-16T14:50:36.841746Z","submitted_at":"2023-10-19T17:57:39Z","title":"AutoMix: Automatically Mixing Language Models","version":5},"cited_work":{"arxiv_id":"2310.12963","doi":"10.48550/arxiv.2310.12963","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.12963","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Automix: Automatically mixing language models","venue":"arXiv (Cornell University)","work_id":"721159b7-a5b2-42e0-94e9-8aa5e1088d57","year":2023},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"cited_paper":"/paper/2310.12963","citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:973417419e73a6e1dfc932efcfc9baf7953abb114ceae07589a664c665fe9d14","observation_id":"865e11cb-6d15-4afd-89e4-f47b1f83dc9b","resolution":{"observed_at":"2026-07-04T14:19:53.633575Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":"Portfolio selection.The Journal of Finance, 7(1):77–91, 1952","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:7ff45a31114dbfb2ef3fa3e95855a3b1f26d67137787f079ad36ff5be5b924e7","observation_id":"8f018305-73eb-4b85-a6ba-34989c492da8","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":"Marshall and Ingram Olkin","venue":null,"work_id":null,"year":1967},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:3dc352b8d4884936aced6291a1f73091f31c86a201a7e039927c5c03de14bf5a","observation_id":"0b533e17-de81-4770-90ca-fd45c94ae6ea","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":"The value of waiting to invest.The Quarterly Journal of Economics, 101(4):707–727, 1986","venue":null,"work_id":null,"year":1986},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:2dcb16a60217b18d0605e29c2f965d7dba56f3018570f0fe1b6c6031726e080d","observation_id":"e390aa53-487c-472c-9fd6-3fac86aadf17","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":null,"venue":null,"work_id":null,"year":1976},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:6fdbebc608741bf91aed7ef0e62d607ff5b3ccd3a35d52ee0c646dc9f94d903f","observation_id":"2ab27fe4-d1f5-408c-b09e-89c9af180ba5","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":"Maximum likelihood estimation of the polychoric correlation coefficient.Psychome- trika, 44(4):443–460, 1979","venue":null,"work_id":null,"year":1979},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:9661f5bac64149a8d59a91842b200c0fc84424e98dd7b9b14cf5278d5a2342a0","observation_id":"63c4cfb9-ee5e-463c-8452-a3f134ca8e20","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18665","last_updated":"2025-02-23T08:50:33Z","snapshot_observed_at":"2026-08-16T00:08:23.767909Z","submitted_at":"2024-06-26T18:10:22Z","title":"RouteLLM: Learning to Route LLMs with Preference Data","version":4},"cited_work":{"arxiv_id":"2406.18665","doi":"10.48550/arxiv.2406.18665","metadata_source":"pith","pith_arxiv_id":"2406.18665","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RouteLLM: Learning to Route LLMs with Preference Data","venue":"cs.LG","work_id":"f6b91d8a-ce78-4b5e-9dae-6dd8a22cc087","year":2024},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"cited_paper":"/paper/2406.18665","citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:6f63dbae7fd4f5c7dc1d9132c01be20e146d4957c2a44de982e3d13a658b56d4","observation_id":"fa7d0f24-9617-44dc-9cbb-3369fe87ec2c","resolution":{"observed_at":"2026-07-04T14:19:53.620197Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-15T07:08:14.190615+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-15T07:08:14.190615+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":"Mathematical contributions to the theory of evolution","venue":null,"work_id":null,"year":1900},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:b4bdb3511d4f7cf552c57c98de349cefbf27eaca3b24b4f2cd937ff044c00dba","observation_id":"82fe22aa-69da-49e0-a3b4-37a0d187e978","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":"Bivariate extreme statistics, i.Annals of the Institute of Statistical Mathematics, 11(2):195–210, 1959","venue":null,"work_id":null,"year":1959},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:a8bcadad08872f7c472ac7d13de399c57b236eb5834280e1e5baa9b0989cec73","observation_id":"f798fb30-40b5-4310-aac8-0241ee463e85","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2307/2330969","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"How many stocks make a diversified portfolio?Journal of Financial and Quantitative Analysis, 22(3):353–363, 1987","venue":"Journal of Financial and Quantitative Analysis","work_id":"1c877d6f-47b1-4d23-89ea-ae989dba9ec4","year":1987},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:47a64dc17db3e65e07c8c5db8e46ffc31dfc513bcac201f4f308089a3935defd","observation_id":"e641ab3b-d1ff-4cf3-8d11-0cd60afcb3e3","resolution":{"observed_at":"2026-06-26T05:29:00.401113Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.08003","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T14:19:53.637937Z","title":"arXiv preprint arXiv:2602.08003 , year =","venue":null,"work_id":"b3f6eab8-61ad-4275-aca8-8344849d5a6a","year":2026},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:34589fad13d3f03865a8b394a92915e327050edf5c2c5a076512a5f4e4f51c18","observation_id":"8d2f9bd3-7770-4368-90c5-72294826820b","resolution":{"observed_at":"2026-07-04T14:19:53.639847Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":"Generalization error of ensemble estimators","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:58e79de15c41ee270a7a281f9449be3764a73e721a79ab9df00debe53d75c693","observation_id":"97ce85bb-34e9-4212-8de9-c4ef6fd1cc07","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04692","last_updated":"2024-06-07T07:04:10Z","snapshot_observed_at":"2026-08-13T12:11:51.471762Z","submitted_at":"2024-06-07T07:04:10Z","title":"Mixture-of-Agents Enhances Large Language Model Capabilities","version":1},"cited_work":{"arxiv_id":"2406.04692","doi":"10.48550/arxiv.2406.04692","metadata_source":"pith","pith_arxiv_id":"2406.04692","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixture-of-Agents Enhances Large Language Model Capabilities","venue":"cs.CL","work_id":"3efec870-3e92-4baa-be9f-50e1aa07140f","year":2024},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"cited_paper":"/paper/2406.04692","citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:62e236befd31b6f310d1a57e8d1caed80f87db8b0c72908f292217c273ea3e2e","observation_id":"962a02f0-6fe8-4431-9b1b-7eb7db5bacfb","resolution":{"observed_at":"2026-07-04T14:19:53.602587Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.03962","last_updated":"2024-02-07T10:11:39Z","snapshot_observed_at":"2026-08-19T01:11:34.310293Z","submitted_at":"2023-01-10T13:51:07Z","title":"A Unified Theory of Diversity in Ensemble Learning","version":3},"cited_work":{"arxiv_id":"2301.03962","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2301.03962","snapshot_observed_at":"2026-07-04T14:19:53.641234Z","title":"orchestration is allocation","venue":null,"work_id":"3dc2d202-e7ec-4802-ad78-8efa12a463b2","year":2023},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"cited_paper":"/paper/2301.03962","citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:fdddad12d2bfc1b82abde20a5009632f51b8d033ca1e4dc2a3c70798e4931cbd","observation_id":"66a6a302-1149-45d3-9eb5-a31e24118f6b","resolution":{"observed_at":"2026-07-04T14:19:53.642727Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:86155c86bdd4c74a5bcec06e18acd0dff9ca8bd2e2d77ed3194cc8dadbb632c6","observation_id":"5f08d2c2-699d-46fe-8bde-472e06548d04","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":"thinking","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:ec1cfb2c28e86494f20af55fadd1c45beafe6c46fd27bb68d1c351f4fe185cb1","observation_id":"7e00cdc3-ce17-41e2-90a8-8f6c4affdca7","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T04:20:02.722108Z","title":null,"venue":null,"work_id":null,"year":1900},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:b9973576a7f9069bc71d5640fb8c82241dd3652482524a7b01e429381c7f0eab","observation_id":"b1dde4e9-a8c0-4d18-8c72-fe784d82909f","resolution":{"observed_at":"2026-06-26T04:20:02.722108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":15,"verified_fuzzy":0},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 3 inbound Pith citation observations for arXiv:2606.27288."}