{"as_of":"2026-08-23T12:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:645a548a94c7d602bbe46c17b9ca500912b7f97d42d2b5f565108b68b7707dd0","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T18:11:28.194047Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":25,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T10:20:58.826813Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T02:35:53.862220Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-08-07T14:12:35.899732Z","title":"Rethinking mixture-of-agents: Is mixing different large language models beneficial?arXiv preprint arXiv:2502.00674, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19797","last_updated":"2025-06-18T09:47:20Z","snapshot_observed_at":"2026-08-17T20:19:26.264835Z","submitted_at":"2025-05-26T10:29:42Z","title":"The Avengers: A Simple Recipe for Uniting Smaller Language Models to Challenge Proprietary Giants","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:12:35.899732Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2505.19797"},"observation_digest":"sha256:162e6113798fa974173acf9a93b2689390ea76a85fb333ec49236f392b7d4b92","observation_id":"dd312a38-b50a-40bb-8035-fc42a18c168a","resolution":{"observed_at":"2026-08-07T14:12:35.899732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":"2502.00674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-07-09T02:35:53.862220Z","title":"Rethinking mixture-of-agents: Is mixing different large language models beneficial?","venue":"cs.CL","work_id":"c6745a0f-feed-481a-8c8e-4986a80b8afe","year":2025},"citing_paper":{"arxiv_id":"2507.14200","last_updated":"2026-05-15T13:08:04Z","snapshot_observed_at":"2026-08-13T18:37:34.518584Z","submitted_at":"2025-07-14T16:17:11Z","title":"A Scalable Multi-LLM Collaboration System with Retrieval-based Selection and Exploration-Exploitation-Driven Enhancement","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-21T23:26:38.457193Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2507.14200"},"observation_digest":"sha256:75ba0b461bfd198cfbeac15ac983de20e95e3f8a5eb27d4e1077c3c2457c2020","observation_id":"c8d63913-ab70-455d-94e4-b3d9ef9f2aba","resolution":{"observed_at":"2026-05-21T23:30:46.127698Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":"2502.00674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-07-09T02:35:53.862220Z","title":"Rethinking mixture-of-agents: Is mixing different large language models beneficial?","venue":"cs.CL","work_id":"c6745a0f-feed-481a-8c8e-4986a80b8afe","year":2025},"citing_paper":{"arxiv_id":"2507.21159","last_updated":"2026-05-12T06:29:43Z","snapshot_observed_at":"2026-08-15T04:38:54.626704Z","submitted_at":"2025-07-25T04:21:16Z","title":"MAC: Masked Agent Collaboration Boosts Large Language Model Medical Decision-Making","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-19T03:12:23.075137Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2507.21159"},"observation_digest":"sha256:1e55942f2e4049fe58d515415e1edd3f89036447b7c4080a67fe0f16e46e2807","observation_id":"c6e1b00e-c859-4a1a-b896-c15f9330d962","resolution":{"observed_at":"2026-05-19T03:12:56.597860Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-08-04T22:03:02.011254Z","title":"Rethinking mixture-of-agents: Is mixing differ- ent large language models beneficial?arXiv preprint arXiv:2502.00674,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.07571","last_updated":"2025-09-11T02:09:54Z","snapshot_observed_at":"2026-08-17T04:15:32.603336Z","submitted_at":"2025-09-09T10:15:42Z","title":"Towards Generalized Routing: Model and Agent Orchestration for Adaptive and Efficient Inference","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-04T22:03:02.011254Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2509.07571"},"observation_digest":"sha256:18d04ced3f8b49079b56703b4818d45d28d8669b85a8d327a1ae5c099c44714f","observation_id":"d26b3cd4-b532-4037-adf7-807fa791a3a4","resolution":{"observed_at":"2026-08-04T22:03:02.011254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":"2502.00674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-07-09T02:35:53.862220Z","title":"Rethinking mixture-of-agents: Is mixing different large language models beneficial?","venue":"cs.CL","work_id":"c6745a0f-feed-481a-8c8e-4986a80b8afe","year":2025},"citing_paper":{"arxiv_id":"2512.22579","last_updated":"2026-05-07T07:31:10Z","snapshot_observed_at":"2026-08-12T13:49:42.123444Z","submitted_at":"2025-12-27T12:42:47Z","title":"SANet: A Semantic-aware Agentic AI Networking Framework for Cross-layer Optimization in 6G","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-16T19:21:51.147059Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2512.22579"},"observation_digest":"sha256:52bd53a611604581115a37c090f351becbbb94941d0baddfab1383b00b313dc0","observation_id":"b2e1f9b0-0753-4a1e-80e9-aa77ddfde37c","resolution":{"observed_at":"2026-05-16T19:23:19.704354Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":"2502.00674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-07-09T02:35:53.862220Z","title":"Rethinking mixture-of-agents: Is mixing different large language models beneficial?","venue":"cs.CL","work_id":"c6745a0f-feed-481a-8c8e-4986a80b8afe","year":2025},"citing_paper":{"arxiv_id":"2602.19509","last_updated":"2026-04-12T18:00:25Z","snapshot_observed_at":"2026-08-14T08:53:31.618453Z","submitted_at":"2026-02-23T04:47:47Z","title":"Pyramid MoA: A Probabilistic Framework for Cost-Optimized Anytime Inference","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:19.285759Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2602.19509"},"observation_digest":"sha256:2a105b79e4834aef6426b7819f10db72c040da7a3dd3879a2922b1dce42d1d5b","observation_id":"bb3387f5-6e8d-4d6a-954d-753b09efa882","resolution":{"observed_at":"2026-05-15T21:01:39.079307Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-08-02T17:52:54.777529Z","title":"More agents is all you need: Self-MoA outperforms mixed-MoA.arXiv preprint arXiv:2502.00674, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.20324","last_updated":"2026-07-21T00:19:03Z","snapshot_observed_at":"2026-08-07T10:38:46.914990Z","submitted_at":"2026-03-20T00:50:53Z","title":"When Agents Disagree: The Selection Bottleneck in Multi-Agent LLM Pipelines","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T17:52:54.777529Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2603.20324"},"observation_digest":"sha256:3aeb29fcdf9ab71b8c75f1ab70ff4e8ec0ab379ccd5d34652fbd11f65e045ace","observation_id":"efc449e2-c2b8-4f27-8fe2-a80dc9809ae1","resolution":{"observed_at":"2026-08-02T17:52:54.777529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":"2502.00674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-07-09T02:35:53.862220Z","title":"Rethinking mixture-of-agents: Is mixing different large language models beneficial?","venue":"cs.CL","work_id":"c6745a0f-feed-481a-8c8e-4986a80b8afe","year":2025},"citing_paper":{"arxiv_id":"2604.19049","last_updated":"2026-04-21T03:55:35Z","snapshot_observed_at":"2026-08-21T08:17:55.760209Z","submitted_at":"2026-04-21T03:55:35Z","title":"Refute-or-Promote: An Adversarial Stage-Gated Multi-Agent Review Methodology for High-Precision LLM-Assisted Defect Discovery","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-10T03:11:26.513954Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2604.19049"},"observation_digest":"sha256:1f85bef96844d034ccc7e021924491eef2bba257b3c6d969fb5c66b5c76a87b5","observation_id":"7989332e-9ff9-4fc1-89ab-3e340bfed179","resolution":{"observed_at":"2026-05-10T03:14:08.036447Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":"2502.00674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-07-09T02:35:53.862220Z","title":"Rethinking mixture-of-agents: Is mixing different large language models beneficial?","venue":"cs.CL","work_id":"c6745a0f-feed-481a-8c8e-4986a80b8afe","year":2025},"citing_paper":{"arxiv_id":"2604.21950","last_updated":"2026-04-23T00:34:54Z","snapshot_observed_at":"2026-08-18T08:00:17.222130Z","submitted_at":"2026-04-23T00:34:54Z","title":"Feedback Over Form: Why Execution Feedback Matters More Than Pipeline Topology in 1-3B Code Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-09T21:37:28.871977Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2604.21950"},"observation_digest":"sha256:cbd1a471e3667e215f2e7786e8e0916d255479e733f3208ab76f0b3ad065c3bd","observation_id":"3bb498d0-8929-4cc2-ad25-11f7561b7aac","resolution":{"observed_at":"2026-05-11T14:31:07.900933Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":"2502.00674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-07-09T02:35:53.862220Z","title":"Rethinking mixture-of-agents: Is mixing different large language models beneficial?","venue":"cs.CL","work_id":"c6745a0f-feed-481a-8c8e-4986a80b8afe","year":2025},"citing_paper":{"arxiv_id":"2605.09121","last_updated":"2026-05-09T19:14:33Z","snapshot_observed_at":"2026-08-08T19:11:23.018391Z","submitted_at":"2026-05-09T19:14:33Z","title":"A Communication-Theoretic Framework for LLM Agents: Cost-Aware Adaptive Reliability","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-12T03:03:05.715652Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2605.09121"},"observation_digest":"sha256:540006bbe2447f5f878b351c6cd13a643937e30f7e64bb3ff471f26079a71b7e","observation_id":"e05a2ec6-f018-4197-87d9-d7d0a668fe63","resolution":{"observed_at":"2026-05-12T03:06:19.449040Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":"2502.00674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-07-09T02:35:53.862220Z","title":"Rethinking mixture-of-agents: Is mixing different large language models beneficial?","venue":"cs.CL","work_id":"c6745a0f-feed-481a-8c8e-4986a80b8afe","year":2025},"citing_paper":{"arxiv_id":"2605.19418","last_updated":"2026-05-19T06:11:11Z","snapshot_observed_at":"2026-08-12T13:54:42.490293Z","submitted_at":"2026-05-19T06:11:11Z","title":"Conflict-Resilient Multi-Agent Reasoning via Signed Graph Modeling","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-20T05:47:27.833457Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2605.19418"},"observation_digest":"sha256:097070cbc988821fcccbf201c8bf8c5e9d8faed1792c714a00c81efa15604a5d","observation_id":"4fdda3c0-d80a-43de-963e-bc55451799a7","resolution":{"observed_at":"2026-05-20T05:48:04.402984Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":"2502.00674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-07-09T02:35:53.862220Z","title":"Rethinking mixture-of-agents: Is mixing different large language models beneficial?","venue":"cs.CL","work_id":"c6745a0f-feed-481a-8c8e-4986a80b8afe","year":2025},"citing_paper":{"arxiv_id":"2606.00405","last_updated":"2026-05-29T22:47:04Z","snapshot_observed_at":"2026-08-12T17:10:12.092715Z","submitted_at":"2026-05-29T22:47:04Z","title":"From Talking Words to Sharing Thoughts: Scalable Multi-LLM Aggregation via Structured Message Passing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T19:30:54.817438Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2606.00405"},"observation_digest":"sha256:2b3d57c0cc098d4167ce7474b625e3e7e0d0810168938f20b34a38010a539a7f","observation_id":"38f7be95-357d-4826-ae99-f6394daaaf1a","resolution":{"observed_at":"2026-06-28T19:32:34.793486Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":"2502.00674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-07-09T02:35:53.862220Z","title":"Rethinking mixture-of-agents: Is mixing different large language models beneficial?","venue":"cs.CL","work_id":"c6745a0f-feed-481a-8c8e-4986a80b8afe","year":2025},"citing_paper":{"arxiv_id":"2606.02646","last_updated":"2026-05-31T16:19:54Z","snapshot_observed_at":"2026-08-15T14:30:19.875097Z","submitted_at":"2026-05-31T16:19:54Z","title":"The Ringelmann Effect in Multi-Agent LLM Systems: A Scaling Law for Effective Team Size","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-06-28T16:04:37.244398Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2606.02646"},"observation_digest":"sha256:a6cf1c0e7c16ba80fe9c942d2ef9a2fccd51c2b5320b2f40cf4e719324ae3709","observation_id":"53f3176b-e6c3-4c89-b2a7-03817e77fe8c","resolution":{"observed_at":"2026-07-01T21:56:15.575218Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":"2502.00674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-07-09T02:35:53.862220Z","title":"Rethinking mixture-of-agents: Is mixing different large language models beneficial?","venue":"cs.CL","work_id":"c6745a0f-feed-481a-8c8e-4986a80b8afe","year":2025},"citing_paper":{"arxiv_id":"2606.03014","last_updated":"2026-06-02T01:40:33Z","snapshot_observed_at":"2026-08-18T10:30:51.054620Z","submitted_at":"2026-06-02T01:40:33Z","title":"MOSAIC: Efficient Mixture-of-Agent Scheduling via Adaptive Aggregation and Inference Concurrency","version":1},"reference_index":169,"source":"arxiv_source","source_observed_at":"2026-06-28T11:34:24.019560Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2606.03014"},"observation_digest":"sha256:144e37b8b6bfa047d7b68c986a57da5e5e96a8d0c6a87ca8d73baaf2a16c224c","observation_id":"77330c8b-66df-44bc-bfdf-0b28e04cb089","resolution":{"observed_at":"2026-07-02T01:46:26.660933Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":"2502.00674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-07-09T02:35:53.862220Z","title":"Rethinking mixture-of-agents: Is mixing different large language models beneficial?","venue":"cs.CL","work_id":"c6745a0f-feed-481a-8c8e-4986a80b8afe","year":2025},"citing_paper":{"arxiv_id":"2606.03544","last_updated":"2026-06-02T12:08:38Z","snapshot_observed_at":"2026-08-14T09:26:47.282519Z","submitted_at":"2026-06-02T12:08:38Z","title":"SAGE: A Quantitative Evaluation of Socialized Evolution in Agent Ecosystems","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T10:02:25.870386Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2606.03544"},"observation_digest":"sha256:c8fd536a70c77f99eb00a9b3f9aa9dfc66d50d04f5b1a3bbc595fda3899b83d8","observation_id":"dc7545c2-920c-4b65-b142-a213aa6189d1","resolution":{"observed_at":"2026-07-02T03:26:29.544533Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":"2502.00674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-07-09T02:35:53.862220Z","title":"Rethinking mixture-of-agents: Is mixing different large language models beneficial?","venue":"cs.CL","work_id":"c6745a0f-feed-481a-8c8e-4986a80b8afe","year":2025},"citing_paper":{"arxiv_id":"2606.06941","last_updated":"2026-06-05T06:12:11Z","snapshot_observed_at":"2026-08-17T06:42:03.552479Z","submitted_at":"2026-06-05T06:12:11Z","title":"Quantum-Inspired Trace-Augmented Evidence Selection for Reasoning over Structured Hypothesis Spaces","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T21:57:20.848868Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2606.06941"},"observation_digest":"sha256:9f52e757cf9b934dc185030c2bbbb83dda00f5551a7437eb8d736205be4b487a","observation_id":"95d301f8-fc3f-4db9-bcc3-28649118f90b","resolution":{"observed_at":"2026-07-02T17:37:14.606270Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":"2502.00674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-07-09T02:35:53.862220Z","title":"Rethinking mixture-of-agents: Is mixing different large language models beneficial?","venue":"cs.CL","work_id":"c6745a0f-feed-481a-8c8e-4986a80b8afe","year":2025},"citing_paper":{"arxiv_id":"2606.11470","last_updated":"2026-08-10T19:13:02Z","snapshot_observed_at":"2026-08-14T23:09:31.705348Z","submitted_at":"2026-06-09T21:59:37Z","title":"The Periodic Table of LLM Reasoning: A Structured Survey of Reasoning Paradigms, Methods, and Failure Modes","version":1},"reference_index":142,"source":"arxiv_source","source_observed_at":"2026-06-27T12:59:51.091008Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2606.11470"},"observation_digest":"sha256:edb4672c12a311d031d33c3831c3f031aadaf8ce439fbf47323ec360bfbf3057","observation_id":"d7bf5828-aaec-4f26-b4f5-393b48678ad4","resolution":{"observed_at":"2026-07-03T05:57:41.557729Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":"2502.00674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-07-09T02:35:53.862220Z","title":"Rethinking mixture-of-agents: Is mixing different large language models beneficial?","venue":"cs.CL","work_id":"c6745a0f-feed-481a-8c8e-4986a80b8afe","year":2025},"citing_paper":{"arxiv_id":"2606.24437","last_updated":"2026-06-23T11:14:37Z","snapshot_observed_at":"2026-08-15T14:39:29.855346Z","submitted_at":"2026-06-23T11:14:37Z","title":"ReM-MoA: Reasoning Memory Sustains Mixture-of-Agents Scaling","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-25T23:37:00.625558Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2606.24437"},"observation_digest":"sha256:a24ccee5ca12807e99778d161d8d758ca905b27d8817bb4f26e1e62de6cdc9e3","observation_id":"2abc00b9-cb0e-4b08-8102-c79f4bda660b","resolution":{"observed_at":"2026-07-04T17:30:00.780744Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":"2502.00674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-07-09T02:35:53.862220Z","title":"Rethinking mixture-of-agents: Is mixing different large language models beneficial?","venue":"cs.CL","work_id":"c6745a0f-feed-481a-8c8e-4986a80b8afe","year":2025},"citing_paper":{"arxiv_id":"2606.27288","last_updated":"2026-06-25T17:06:06Z","snapshot_observed_at":"2026-08-12T15:58:43.565204Z","submitted_at":"2026-06-25T17:06:06Z","title":"When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T04:20:02.722108Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2606.27288"},"observation_digest":"sha256:12d8e94638448a27d985f1f42c381abd03fd6dd364c9a1155115b37aa8902170","observation_id":"5b5ad1f4-9ad7-4094-9b23-956c4ad5419d","resolution":{"observed_at":"2026-07-04T14:19:53.611757Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-07-12T02:29:58.886380Z","title":"Rethinking mixture-of-agents: Is mixing different large language models beneficial?","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03436","last_updated":"2026-07-07T05:35:41Z","snapshot_observed_at":"2026-08-21T19:52:25.522880Z","submitted_at":"2026-07-03T15:49:40Z","title":"How Much of the Routing Gap Is Real? Decomposing the Router-to-Oracle Gap into Reproducible Specialist Advantage and Single-Draw Label Noise","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-12T02:29:58.886380Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2607.03436"},"observation_digest":"sha256:80355583a21767e921b59cb24514c0f9f39d15026f283839df7def39ee366a66","observation_id":"92d66bfd-91bd-42ea-a4a3-242940b3fdc0","resolution":{"observed_at":"2026-07-12T02:29:58.886380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":"2502.00674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-07-09T02:35:53.862220Z","title":"Rethinking mixture-of-agents: Is mixing different large language models beneficial?","venue":"cs.CL","work_id":"c6745a0f-feed-481a-8c8e-4986a80b8afe","year":2025},"citing_paper":{"arxiv_id":"2607.07690","last_updated":"2026-07-08T17:49:14Z","snapshot_observed_at":"2026-08-18T00:47:39.478171Z","submitted_at":"2026-07-08T17:49:14Z","title":"Agon: Competitive Cross-Model RL with Implicit Rival Grading of Reasoning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-09T02:29:12.366018Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2607.07690"},"observation_digest":"sha256:f67e54be8cc3b275f9cae6aae3d2d9f2e2eade2f87b23dcb0f3689515cf83795","observation_id":"f4478556-1642-4af0-ad24-9a002f7db2fc","resolution":{"observed_at":"2026-07-09T02:35:53.863433Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-08-01T09:29:50.407020Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.20768","last_updated":"2026-07-22T22:34:57Z","snapshot_observed_at":"2026-08-15T17:38:19.627117Z","submitted_at":"2026-07-22T22:34:57Z","title":"Are Diversity Metrics Measuring Diversity? A Capability-Controlled Audit of Majority-Vote Gain in LLM Ensembles","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-01T09:29:50.407020Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2607.20768"},"observation_digest":"sha256:5b9fac77005bdd7f6f17cf16b40cad8ba42f90dc3ed3edacd8feb82e0107f836","observation_id":"e644ca93-f9c8-4749-b528-a1887e91e432","resolution":{"observed_at":"2026-08-01T09:29:50.407020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-08-01T03:57:40.775727Z","title":"Refute-or-Promote: An Adversarial Stage-Gated Multi- Agent Review Methodology for High-Precision LLM-Assisted Defect Discovery","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23002","last_updated":"2026-07-25T02:38:07Z","snapshot_observed_at":"2026-08-09T04:08:38.159012Z","submitted_at":"2026-07-25T02:38:07Z","title":"Adversarial Test-Hardening for AI-Written Code: An Instrument Autopsy and a Pre-Registered Causal Estimate of the Critic Loop","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T03:57:40.775727Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2607.23002"},"observation_digest":"sha256:2fb38fea18c61679c0e0f3ddee60059bc6a380ab56fa4fde7d5d822c01a92df0","observation_id":"ba55738c-e6e6-46c6-b77c-84eb57d5b856","resolution":{"observed_at":"2026-08-01T03:57:40.775727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-08-06T04:47:19.451802Z","title":"arXiv preprint arXiv:2502.00674 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.05124","last_updated":"2026-08-05T17:50:08Z","snapshot_observed_at":"2026-08-17T20:44:36.239569Z","submitted_at":"2026-08-05T17:50:08Z","title":"Chained Recursive Language Models for Multi-Iteration Reasoning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T04:47:19.451802Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2608.05124"},"observation_digest":"sha256:f6beb1126962b424cb7ef28bc36c529a97f75259ee9ca8c787fc4c2bd614bc2f","observation_id":"41f6081d-1b0e-410a-a46f-139c9448904b","resolution":{"observed_at":"2026-08-06T04:47:19.451802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-08-11T10:20:58.826813Z","title":"TiC-LM: A web-scale benchmark for time-continual LLM pretraining","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09819","last_updated":"2026-08-10T16:39:55Z","snapshot_observed_at":"2026-08-18T21:05:33.598724Z","submitted_at":"2026-08-10T16:39:55Z","title":"Macaron-V1: Towards Open Continual Learning with Self-Improvement and Mixture-of-LoRA","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-11T10:20:58.826813Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2608.09819"},"observation_digest":"sha256:bbd382130898f42b6d498033a7905b62ba9bd2fdb49440b17e9532f11e29fb07","observation_id":"e2d17029-7de0-4b96-bc3f-6df644aae589","resolution":{"observed_at":"2026-08-11T10:20:58.826813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.00674/citation-record","integrity":"/paper/2502.00674/integrity","json":"/paper/2502.00674/citation-record.json","paper":"/paper/2502.00674"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-09T18:11:28.084621Z","title":"Achiam, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.084621Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:cc245f6eada9a3953cb93324d9c05e8103d6c32ab870eaee4b514d907913fd07","observation_id":"f5c5f5fc-92e4-46de-9d41-bd4c15318cca","resolution":{"observed_at":"2026-08-09T18:11:28.084621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17311","last_updated":"2023-11-29T02:07:09Z","snapshot_observed_at":"2026-08-16T16:45:56.159370Z","submitted_at":"2023-11-29T02:07:09Z","title":"Universal Self-Consistency for Large Language Model Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17311","snapshot_observed_at":"2026-08-09T18:11:28.106422Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.106422Z"},"links":{"cited_paper":"/paper/2311.17311","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:9fb651de66adca3b7992d56eea6436a30bf27dedb40dbe3bfdc56be998cfb1d5","observation_id":"62e290fd-d6f3-4f53-aa3d-7b26aab95df3","resolution":{"observed_at":"2026-08-09T18:11:28.106422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14325","last_updated":"2023-05-23T17:55:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-23T17:55:11Z","title":"Improving Factuality and Reasoning in Language Models through Multiagent Debate","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14325","snapshot_observed_at":"2026-08-09T18:11:28.110501Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.110501Z"},"links":{"cited_paper":"/paper/2305.14325","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:1d0ee7173dffe39d63dfa4470f79bfd28edf7527141abf3d6153d27dd7dfb703","observation_id":"60a2ba35-8f01-458f-be95-7b590f0fca1d","resolution":{"observed_at":"2026-08-09T18:11:28.110501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04475","last_updated":"2025-03-10T09:27:03Z","snapshot_observed_at":"2026-07-06T17:56:23.317089Z","submitted_at":"2024-04-06T02:29:02Z","title":"Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04475","snapshot_observed_at":"2026-08-09T18:11:28.114379Z","title":"Dubois, B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.114379Z"},"links":{"cited_paper":"/paper/2404.04475","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:9114cb80708ed243774f6f18035af843198f71a91319ae3ce285c3f6099129d5","observation_id":"026daf01-b74e-4e52-9482-11b38839f09d","resolution":{"observed_at":"2026-08-09T18:11:28.114379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04127","last_updated":"2025-01-10T14:31:21Z","snapshot_observed_at":"2026-08-18T22:14:47.638195Z","submitted_at":"2024-06-06T14:49:06Z","title":"Are We Done with MMLU?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04127","snapshot_observed_at":"2026-08-09T18:11:28.118550Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.118550Z"},"links":{"cited_paper":"/paper/2406.04127","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:fc05eab826bc7b12dd5848a94a08609a3436bc7a296f7afa69d2a24e6c2e42b8","observation_id":"1cc04f74-a9be-40ee-b186-aca962c8c081","resolution":{"observed_at":"2026-08-09T18:11:28.118550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03065","last_updated":"2024-01-05T20:53:51Z","snapshot_observed_at":"2026-08-17T23:54:36.836170Z","submitted_at":"2024-01-05T20:53:51Z","title":"CRUXEval: A Benchmark for Code Reasoning, Understanding and Execution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03065","snapshot_observed_at":"2026-08-09T18:11:28.122049Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.122049Z"},"links":{"cited_paper":"/paper/2401.03065","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:be21277fa36573372e7b6c3b33c3f23c80b3bc40cb456cb03c8b012b6b2e3a4b","observation_id":"3b2335e3-504a-49f0-b015-26bb9832d7d9","resolution":{"observed_at":"2026-08-09T18:11:28.122049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00832","last_updated":"2024-11-01T20:02:32Z","snapshot_observed_at":"2026-08-18T02:49:00.286886Z","submitted_at":"2024-06-02T18:42:57Z","title":"BoNBoN Alignment for Large Language Models and the Sweetness of Best-of-n Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00832","snapshot_observed_at":"2026-08-09T18:11:28.125944Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.125944Z"},"links":{"cited_paper":"/paper/2406.00832","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:23a315b43fa35687c23278d1bd4b45fbfecfaa6c03c4a3a18e3f541b514893d0","observation_id":"75f37d1c-a82e-4258-aaaa-c69bf3146d08","resolution":{"observed_at":"2026-08-09T18:11:28.125944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-09T18:11:28.129112Z","title":"Hendrycks, C","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.129112Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:c13068e4cf8da1a3ea09f509edbe00619d70223003bb577fe17d88e00dd2313d","observation_id":"95eda0fb-98f2-44d4-a858-6223ad2cfa2b","resolution":{"observed_at":"2026-08-09T18:11:28.129112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-23T11:47:44.729242Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-09T18:11:28.135024Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.135024Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:c7212172fe7af5056bd9616a47f2b9286e1953b283d6ad5c18f01c1d463c3dc9","observation_id":"a6b5d1c0-2416-4aab-b984-82f1d07fcd96","resolution":{"observed_at":"2026-08-09T18:11:28.135024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05120","last_updated":"2024-10-11T09:38:40Z","snapshot_observed_at":"2026-08-18T10:10:17.969034Z","submitted_at":"2024-02-03T05:55:24Z","title":"More Agents Is All You Need","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05120","snapshot_observed_at":"2026-08-09T18:11:28.138099Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.138099Z"},"links":{"cited_paper":"/paper/2402.05120","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:721a25092697ed6c9fca295262e87f944c7f835b90c7691844768fa1d8d1d874","observation_id":"2049544f-d303-42bf-9664-f2c16521aa19","resolution":{"observed_at":"2026-08-09T18:11:28.138099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06256","last_updated":"2024-10-13T19:27:20Z","snapshot_observed_at":"2026-08-21T08:31:42.500173Z","submitted_at":"2023-09-12T14:16:54Z","title":"Mitigating the Alignment Tax of RLHF","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.06256","snapshot_observed_at":"2026-08-09T18:11:28.144815Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.144815Z"},"links":{"cited_paper":"/paper/2309.06256","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:e9bb0ea5b070a5030ef7618ed9e2eb742f465542a431c8740df52f9af39abacd","observation_id":"7f479c68-b81b-4744-8438-a6a7a5cf0883","resolution":{"observed_at":"2026-08-09T18:11:28.144815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08692","last_updated":"2023-11-15T04:40:43Z","snapshot_observed_at":"2026-08-18T12:06:54.506041Z","submitted_at":"2023-11-15T04:40:43Z","title":"Routing to the Expert: Efficient Reward-guided Ensemble of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08692","snapshot_observed_at":"2026-08-09T18:11:28.148319Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.148319Z"},"links":{"cited_paper":"/paper/2311.08692","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:445f18db9ff8a5c4c269863e23094293869742b897bc463d212c61b897ae421c","observation_id":"066b67fa-bd07-41a5-995a-5b4f6ab1a320","resolution":{"observed_at":"2026-08-09T18:11:28.148319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14734","last_updated":"2024-11-01T20:05:19Z","snapshot_observed_at":"2026-08-20T05:24:55.574908Z","submitted_at":"2024-05-23T16:01:46Z","title":"SimPO: Simple Preference Optimization with a Reference-Free Reward","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14734","snapshot_observed_at":"2026-08-09T18:11:28.152093Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.152093Z"},"links":{"cited_paper":"/paper/2405.14734","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:237a77b2307cdca4412fd0dff14539caaa5544636d382d4377890de395a4e563","observation_id":"6904886a-658d-48c7-b0a1-f449ed55e4b3","resolution":{"observed_at":"2026-08-09T18:11:28.152093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16768","last_updated":"2024-06-24T16:24:34Z","snapshot_observed_at":"2026-08-16T13:40:04.078262Z","submitted_at":"2024-06-24T16:24:34Z","title":"WARP: On the Benefits of Weight Averaged Rewarded Policies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16768","snapshot_observed_at":"2026-08-09T18:11:28.155863Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.155863Z"},"links":{"cited_paper":"/paper/2406.16768","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:3d248fc56119d4850395e4f88d107ef5c334cb5075c64940363c4d4aaf72cc42","observation_id":"86b9cb94-65cf-403b-af4a-d78036678a0b","resolution":{"observed_at":"2026-08-09T18:11:28.155863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-09T18:11:28.159372Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.159372Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:c0962d8c17ff21cc9b843c1aed2381a70047039554048e8ce9022da1a4dfadb3","observation_id":"87f5683d-bf3e-4ef0-b70b-3152f5810ff5","resolution":{"observed_at":"2026-08-09T18:11:28.159372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-08-20T18:27:04.837880Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-09T18:11:28.162824Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.162824Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:e04007ee4c2cf4cebc2959d74d6de38fea9cb8847ff392d78ea14a7d1533a69c","observation_id":"7e8eafca-94da-4b57-ad1d-10ec0d3f8b58","resolution":{"observed_at":"2026-08-09T18:11:28.162824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-21T05:15:28.840279Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-09T18:11:28.166006Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.166006Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:4879e217f4c229385285ab11a8305f281d5e2550cda23c8b8edd48ed3d2c0be7","observation_id":"ae457d7c-c095-4333-ad0e-cfc1ebb184a3","resolution":{"observed_at":"2026-08-09T18:11:28.166006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-09T18:11:28.170286Z","title":"databricks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.170286Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:c4f50a9c15f289aa51c88951648be868206b8aee464edb0144498449cd0d1890","observation_id":"0a740c73-6bab-4bfe-a0e7-46ed6fa6f139","resolution":{"observed_at":"2026-08-09T18:11:28.170286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08118","last_updated":"2023-10-12T08:22:37Z","snapshot_observed_at":"2026-08-18T18:28:45.834142Z","submitted_at":"2023-10-12T08:22:37Z","title":"Can Large Language Models Really Improve by Self-critiquing Their Own Plans?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08118","snapshot_observed_at":"2026-08-09T18:11:28.174002Z","title":"Valmeekam, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.174002Z"},"links":{"cited_paper":"/paper/2310.08118","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:f16cbf3353ea4f9ff431b8e8faa911347eb851dd1aff5c40416c42d6dc73efcf","observation_id":"3cc974f2-a2c4-4171-8590-00b868f03bd0","resolution":{"observed_at":"2026-08-09T18:11:28.174002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04692","last_updated":"2024-06-07T07:04:10Z","snapshot_observed_at":"2026-08-13T12:11:51.471762Z","submitted_at":"2024-06-07T07:04:10Z","title":"Mixture-of-Agents Enhances Large Language Model Capabilities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04692","snapshot_observed_at":"2026-08-09T18:11:28.177534Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.177534Z"},"links":{"cited_paper":"/paper/2406.04692","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:fa431293b1bb92d55ac950e025b00e3eb4495c7d0ee250f3102f711afbca7d03","observation_id":"9b4ea834-0598-4868-99c1-8c5573ebcc13","resolution":{"observed_at":"2026-08-09T18:11:28.177534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00724","last_updated":"2025-03-03T07:53:32Z","snapshot_observed_at":"2026-08-13T03:06:10.986532Z","submitted_at":"2024-08-01T17:16:04Z","title":"Inference Scaling Laws: An Empirical Analysis of Compute-Optimal Inference for Problem-Solving with Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00724","snapshot_observed_at":"2026-08-09T18:11:28.181242Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.181242Z"},"links":{"cited_paper":"/paper/2408.00724","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:34b8af57fd0871c2fe36e0d39c9825c84eb0d9b3f4c59d7420ff556f4db7b6ef","observation_id":"39881245-e23f-4840-b4cf-a3b20b9a554e","resolution":{"observed_at":"2026-08-09T18:11:28.181242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-08-17T11:08:48.802438Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-09T18:11:28.184221Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.184221Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:e3227a6c35cada6e603eb208fe9e860cd1cbcbd237ba8373ef8c3e79fc12ca33","observation_id":"cab92b4d-03b8-4cf1-b4ee-69ae968902e3","resolution":{"observed_at":"2026-08-09T18:11:28.184221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11827","last_updated":"2024-10-03T21:37:02Z","snapshot_observed_at":"2026-08-16T13:42:07.691322Z","submitted_at":"2024-06-17T17:59:13Z","title":"WPO: Enhancing RLHF with Weighted Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11827","snapshot_observed_at":"2026-08-09T18:11:28.187014Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.187014Z"},"links":{"cited_paper":"/paper/2406.11827","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:70b2b44065462a1f8541711c67f4b3ae11d2119a57b737098a0b3719d703042a","observation_id":"a6a2c73c-5fbd-4f8c-916b-3af1b95021ce","resolution":{"observed_at":"2026-08-09T18:11:28.187014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11931","last_updated":"2024-06-17T13:51:35Z","snapshot_observed_at":"2026-08-14T04:42:19.578053Z","submitted_at":"2024-06-17T13:51:35Z","title":"DeepSeek-Coder-V2: Breaking the Barrier of Closed-Source Models in Code Intelligence","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11931","snapshot_observed_at":"2026-08-09T18:11:28.190289Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.190289Z"},"links":{"cited_paper":"/paper/2406.11931","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:a0e95c0101b742304ca7c2666e3bbbdb3ff15615a3ac57745f0918f945d8dd80","observation_id":"c3f19c79-7190-454a-8bb5-2e15464bb263","resolution":{"observed_at":"2026-08-09T18:11:28.190289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T18:11:28.491014Z","title":"This metric provides a quantitative measure of diversity based on the distribution of similarity scores among the samples","venue":null,"work_id":"7c6e4f47-a97c-47a7-abc9-679ccc5e0f81","year":2020},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.194047Z"},"links":{"citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:68dadc3e2dd0517061026d11da8401c1c85c98bce0780ad2f484105cf5a16ab6","observation_id":"05b6ed2b-2cc4-40dd-a844-607a0af43435","resolution":{"observed_at":"2026-08-09T18:11:28.496564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-20T15:31:01.041088Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-09T18:11:28.089207Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":1990,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.089207Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:5bb787496ab4d4e2f4c9a560e5207b5880d65e2aaac85b85f70ca242cf723f23","observation_id":"841ace05-388c-48ac-846d-b0398f6135a5","resolution":{"observed_at":"2026-08-09T18:11:28.089207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-08-21T04:25:41.592030Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-09T18:11:28.132201Z","title":"Hendrycks, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.132201Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:bf2be8e31cde071626319713e460cc90905e44179da1b72fc41d0c8d10ca83c2","observation_id":"0fff154a-5fb1-4115-b2e1-ff34a3180661","resolution":{"observed_at":"2026-08-09T18:11:28.132201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07487","last_updated":"2024-09-13T19:42:12Z","snapshot_observed_at":"2026-08-16T13:21:17.701266Z","submitted_at":"2024-09-04T19:00:59Z","title":"MoA is All You Need: Building LLM Research Team using Mixture of Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.07487","snapshot_observed_at":"2026-08-09T18:11:28.101723Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.101723Z"},"links":{"cited_paper":"/paper/2409.07487","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:36085fad4e0fcd63b797f3668cd5bb88d8cda0a0576096b08b855b3800a9080e","observation_id":"c3860c71-e172-46a8-b888-aafa58327361","resolution":{"observed_at":"2026-08-09T18:11:28.101723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.19118","last_updated":"2024-10-09T02:41:21Z","snapshot_observed_at":"2026-08-15T13:46:19.286791Z","submitted_at":"2023-05-30T15:25:45Z","title":"Encouraging Divergent Thinking in Large Language Models through Multi-Agent Debate","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.19118","snapshot_observed_at":"2026-08-09T18:11:28.141367Z","title":"Liang, Z","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.141367Z"},"links":{"cited_paper":"/paper/2305.19118","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:ec9d8048b79f101c1cd9c03a533c2a8683bff5f76ea61703103762554a60c51d","observation_id":"cbdcf36f-8c23-4679-a5c6-6c45cfa1f22a","resolution":{"observed_at":"2026-08-09T18:11:28.141367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-08-14T10:00:52.343929Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-09T18:11:28.093469Z","title":"Brown, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.093469Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:d3fa441fd17f49b94cf221e79314754c986ecbedab996df72671c9b6b162e2bd","observation_id":"877e828b-90fb-4ff9-9a91-1fe3392820fd","resolution":{"observed_at":"2026-08-09T18:11:28.093469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.13007","last_updated":"2024-06-21T19:34:27Z","snapshot_observed_at":"2026-08-19T13:14:39.854462Z","submitted_at":"2023-09-22T17:12:45Z","title":"ReConcile: Round-Table Conference Improves Reasoning via Consensus among Diverse LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.13007","snapshot_observed_at":"2026-08-09T18:11:28.097949Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-09T18:11:28.097949Z"},"links":{"cited_paper":"/paper/2309.13007","citing_paper":"/paper/2502.00674"},"observation_digest":"sha256:b1117506fcced98c2a27deb323c3b8d9769ac062870e070c67ff6487b8ddb0be","observation_id":"f94775e2-417c-4ae4-bce8-fbb811c4a495","resolution":{"observed_at":"2026-08-09T18:11:28.097949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-21T21:50:29.841827Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 25 inbound Pith citation observations for arXiv:2502.00674."}