{"as_of":"2026-07-27T12:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cf53a079af3316ca455bf12ec2645e342d8bfe0be9abcceb2f5b994a6b4f1814","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-09T14:07:43.507761Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-07-27T06:30:09.085275+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-09T03:36:57.168246Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T03:45:55.534976Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.01566","last_updated":"2026-05-02T18:31:02Z","snapshot_observed_at":"2026-07-06T23:14:47.444386Z","submitted_at":"2026-05-02T18:31:02Z","title":"Multi-Agent Reasoning Improves Compute Efficiency: Pareto-Optimal Test-Time Scaling","version":1},"cited_work":{"arxiv_id":"2605.01566","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.01566","snapshot_observed_at":"2026-07-09T03:45:55.534976Z","title":"Multi-Agent Reasoning Improves Compute Efficiency: Pareto-Optimal Test-Time Scaling","venue":"cs.AI","work_id":"7da1ea03-bbbf-4998-8896-d3b5496ff304","year":2026},"citing_paper":{"arxiv_id":"2607.07663","last_updated":"2026-07-08T17:19:50Z","snapshot_observed_at":"2026-07-11T23:20:19.060405Z","submitted_at":"2026-07-08T17:19:50Z","title":"Recursive Self-Improvement in AI: From Bounded Self-Refinement to Autonomous Research Loops","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-07-09T03:36:57.168246Z"},"links":{"cited_paper":"/paper/2605.01566","citing_paper":"/paper/2607.07663"},"observation_digest":"sha256:61c73f22e83a1ab437fd8a1a74b6a08275f87080d7ea2f8ba62939b3f74c7adf","observation_id":"532cbc44-7530-4413-97c4-723818559cab","resolution":{"observed_at":"2026-07-09T03:45:55.536724Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2605.01566/citation-record","integrity":"/paper/2605.01566/integrity","json":"/paper/2605.01566/citation-record.json","paper":"/paper/2605.01566"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.19559","last_updated":"2026-04-09T08:14:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-26T20:54:51Z","title":"Stay Focused: Problem Drift in Multi-Agent Debate","version":3},"cited_work":{"arxiv_id":"2502.19559","doi":"10.48550/arxiv.2502.19559","metadata_source":"pith","pith_arxiv_id":"2502.19559","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Stay Focused: Problem Drift in Multi-Agent Debate","venue":"cs.CL","work_id":"5402a67b-3f0d-462c-a3f0-477d7ed48bfe","year":2025},"citing_paper":{"arxiv_id":"2605.01566","last_updated":"2026-05-02T18:31:02Z","snapshot_observed_at":"2026-07-06T23:14:47.444386Z","submitted_at":"2026-05-02T18:31:02Z","title":"Multi-Agent Reasoning Improves Compute Efficiency: Pareto-Optimal Test-Time Scaling","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-09T14:07:43.507761Z"},"links":{"cited_paper":"/paper/2502.19559","citing_paper":"/paper/2605.01566"},"observation_digest":"sha256:994f2cdebff6b708321c17de2ce123d3d3418df2518df2846f82c29688712fff","observation_id":"b1d3d7c6-86b6-46d1-9156-6c8fed48d02f","resolution":{"observed_at":"2026-05-11T17:06:03.954920Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2605.01566","last_updated":"2026-05-02T18:31:02Z","snapshot_observed_at":"2026-07-06T23:14:47.444386Z","submitted_at":"2026-05-02T18:31:02Z","title":"Multi-Agent Reasoning Improves Compute Efficiency: Pareto-Optimal Test-Time Scaling","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-09T14:07:43.507761Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2605.01566"},"observation_digest":"sha256:292ca37d346fc93d0ebf4d85a1604cf4a547f310acc0dd7e093b5fa79ac191b4","observation_id":"327d15b7-e6a5-469b-b23c-5fb5bac26362","resolution":{"observed_at":"2026-05-11T17:06:03.958989Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14325","last_updated":"2023-05-23T17:55:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-23T17:55:11Z","title":"Improving Factuality and Reasoning in Language Models through Multiagent Debate","version":1},"cited_work":{"arxiv_id":"2305.14325","doi":"10.48550/arxiv.2305.14325","metadata_source":"pith","pith_arxiv_id":"2305.14325","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Improving Factuality and Reasoning in Language Models through Multiagent Debate","venue":"cs.CL","work_id":"a543e65c-1cf8-4182-b03b-33c0cd2c65d5","year":2023},"citing_paper":{"arxiv_id":"2605.01566","last_updated":"2026-05-02T18:31:02Z","snapshot_observed_at":"2026-07-06T23:14:47.444386Z","submitted_at":"2026-05-02T18:31:02Z","title":"Multi-Agent Reasoning Improves Compute Efficiency: Pareto-Optimal Test-Time Scaling","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-09T14:07:43.507761Z"},"links":{"cited_paper":"/paper/2305.14325","citing_paper":"/paper/2605.01566"},"observation_digest":"sha256:89cdbb41832e232360b03c07fa5da5a61a46db8f2987962942ff93e624bbf189","observation_id":"94f9400c-5db8-4f85-842a-4162020c0d57","resolution":{"observed_at":"2026-05-12T03:01:45.301651Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01798","last_updated":"2024-03-14T04:27:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-03T04:56:12Z","title":"Large Language Models Cannot Self-Correct Reasoning Yet","version":2},"cited_work":{"arxiv_id":"2310.01798","doi":"10.48550/arxiv.2310.01798","metadata_source":"pith","pith_arxiv_id":"2310.01798","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Models Cannot Self-Correct Reasoning Yet","venue":"cs.CL","work_id":"f63b261b-ef16-40f5-993b-9d37b1a51b92","year":2023},"citing_paper":{"arxiv_id":"2605.01566","last_updated":"2026-05-02T18:31:02Z","snapshot_observed_at":"2026-07-06T23:14:47.444386Z","submitted_at":"2026-05-02T18:31:02Z","title":"Multi-Agent Reasoning Improves Compute Efficiency: Pareto-Optimal Test-Time Scaling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-09T14:07:43.507761Z"},"links":{"cited_paper":"/paper/2310.01798","citing_paper":"/paper/2605.01566"},"observation_digest":"sha256:73514d16999fa1d90c9defdfda06d1e41f3a21937029f5c6f8aa574aec57a36d","observation_id":"3d6190e3-2adc-4199-8762-fdb03b7bf5ef","resolution":{"observed_at":"2026-05-12T05:48:28.335998Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:38.048248+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:38.048248+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"InProceedings of the Fourth Workshop on Scholarly Document Processing (SDP 2024), pages 105–119, Bangkok, Thailand","venue":null,"work_id":"69b476e2-7b64-45fa-8ef0-bdb827785a1f","year":2024},"citing_paper":{"arxiv_id":"2605.01566","last_updated":"2026-05-02T18:31:02Z","snapshot_observed_at":"2026-07-06T23:14:47.444386Z","submitted_at":"2026-05-02T18:31:02Z","title":"Multi-Agent Reasoning Improves Compute Efficiency: Pareto-Optimal Test-Time Scaling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-09T14:07:43.507761Z"},"links":{"citing_paper":"/paper/2605.01566"},"observation_digest":"sha256:bac69201670bd25cb3a7446d1b8efe38f0e47b20a0bb83a6ccad084799f4b210","observation_id":"11b868db-ae8d-4e5e-a1c4-d667044d409c","resolution":{"observed_at":"2026-05-26T02:26:30.158161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.09338","last_updated":"2026-04-10T14:05:50Z","snapshot_observed_at":"2026-07-06T22:58:12.847181Z","submitted_at":"2026-04-10T14:05:50Z","title":"Mind the Gap Between Spatial Reasoning and Acting! Step-by-Step Evaluation of Agents With Spatial-Gym","version":1},"cited_work":{"arxiv_id":"2604.09338","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.09338","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mind the Gap Between Spatial Reasoning and Acting! Step-by-Step Evaluation of Agents With Spatial-Gym","venue":"cs.AI","work_id":"3d43d519-93f5-4096-9bba-5e3bc0aefb41","year":2026},"citing_paper":{"arxiv_id":"2605.01566","last_updated":"2026-05-02T18:31:02Z","snapshot_observed_at":"2026-07-06T23:14:47.444386Z","submitted_at":"2026-05-02T18:31:02Z","title":"Multi-Agent Reasoning Improves Compute Efficiency: Pareto-Optimal Test-Time Scaling","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-09T14:07:43.507761Z"},"links":{"cited_paper":"/paper/2604.09338","citing_paper":"/paper/2605.01566"},"observation_digest":"sha256:f49f1d395de9bd0ba6e233f55451c9e2bc280a53de26211678fe4662e1563420","observation_id":"cd757e76-605d-481c-a94f-b81911b71bce","resolution":{"observed_at":"2026-05-11T17:06:03.926913Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":"2001.08361","doi":"10.1145/3616855.3635845","metadata_source":"pith","pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Scaling Laws for Neural Language Models","venue":"cs.LG","work_id":"b7dd8749-9c45-4977-ab9b-64478dce1ae8","year":2020},"citing_paper":{"arxiv_id":"2605.01566","last_updated":"2026-05-02T18:31:02Z","snapshot_observed_at":"2026-07-06T23:14:47.444386Z","submitted_at":"2026-05-02T18:31:02Z","title":"Multi-Agent Reasoning Improves Compute Efficiency: Pareto-Optimal Test-Time Scaling","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-09T14:07:43.507761Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2605.01566"},"observation_digest":"sha256:84adffaacffb66924839e73129566ae91804bec955550c7afdc7dc08f6fd0446","observation_id":"325bfc76-8678-4d41-946d-5c2757f585bf","resolution":{"observed_at":"2026-05-11T17:06:03.962458Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17651","last_updated":"2023-05-25T19:13:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-30T18:30:01Z","title":"Self-Refine: Iterative Refinement with Self-Feedback","version":2},"cited_work":{"arxiv_id":"2303.17651","doi":"10.1007/s10664-008-","metadata_source":"pith","pith_arxiv_id":"2303.17651","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Self-Refine: Iterative Refinement with Self-Feedback","venue":"cs.CL","work_id":"59181e7f-e58e-45d3-8146-4477a9f53d5a","year":2023},"citing_paper":{"arxiv_id":"2605.01566","last_updated":"2026-05-02T18:31:02Z","snapshot_observed_at":"2026-07-06T23:14:47.444386Z","submitted_at":"2026-05-02T18:31:02Z","title":"Multi-Agent Reasoning Improves Compute Efficiency: Pareto-Optimal Test-Time Scaling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-09T14:07:43.507761Z"},"links":{"cited_paper":"/paper/2303.17651","citing_paper":"/paper/2605.01566"},"observation_digest":"sha256:201b573ee1ef594dac491b287f911874da2568d97fb2df20259ccc84c158f98c","observation_id":"39c0b790-40d8-401f-9589-4db5ccafcdf4","resolution":{"observed_at":"2026-05-11T17:06:03.965474Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2605.01566","last_updated":"2026-05-02T18:31:02Z","snapshot_observed_at":"2026-07-06T23:14:47.444386Z","submitted_at":"2026-05-02T18:31:02Z","title":"Multi-Agent Reasoning Improves Compute Efficiency: Pareto-Optimal Test-Time Scaling","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-09T14:07:43.507761Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2605.01566"},"observation_digest":"sha256:84a8ff7b6d94c555767b2af1dcefee2b9be2ba80c1491877079c318566923663","observation_id":"eb943f7a-b03a-46bd-9a42-0283e59703eb","resolution":{"observed_at":"2026-05-11T17:06:03.932948Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":"2408.03314","doi":"10.18653/v1/2025.acl-long.1486","metadata_source":"pith","pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","venue":"cs.LG","work_id":"a8d50b24-bdf5-46ed-bc4f-2927dfd81f1d","year":2024},"citing_paper":{"arxiv_id":"2605.01566","last_updated":"2026-05-02T18:31:02Z","snapshot_observed_at":"2026-07-06T23:14:47.444386Z","submitted_at":"2026-05-02T18:31:02Z","title":"Multi-Agent Reasoning Improves Compute Efficiency: Pareto-Optimal Test-Time Scaling","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-09T14:07:43.507761Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2605.01566"},"observation_digest":"sha256:a171b24b5c6c7cdf997d98bdae79985d3f04c1f80aedb98ab266cdab3c8d4b4a","observation_id":"5039904a-1f1f-4379-809d-79398ce67b24","resolution":{"observed_at":"2026-05-11T17:06:03.950400Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":"2210.09261","doi":"10.48550/arxiv.2210.09261","metadata_source":"pith","pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","venue":"cs.CL","work_id":"513eb205-04ca-4722-9a43-a74e8cbe7e85","year":2022},"citing_paper":{"arxiv_id":"2605.01566","last_updated":"2026-05-02T18:31:02Z","snapshot_observed_at":"2026-07-06T23:14:47.444386Z","submitted_at":"2026-05-02T18:31:02Z","title":"Multi-Agent Reasoning Improves Compute Efficiency: Pareto-Optimal Test-Time Scaling","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-09T14:07:43.507761Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2605.01566"},"observation_digest":"sha256:38eef52d90d08ba258785e04be6ec526dd26ff706fc8337e0ebc6e15959c9bef","observation_id":"7552b230-5f20-47e3-8b64-b7e88137f3b4","resolution":{"observed_at":"2026-05-11T17:01:10.451911Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04692","last_updated":"2024-06-07T07:04:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-07T07:04:10Z","title":"Mixture-of-Agents Enhances Large Language Model Capabilities","version":1},"cited_work":{"arxiv_id":"2406.04692","doi":"10.48550/arxiv.2406.04692","metadata_source":"pith","pith_arxiv_id":"2406.04692","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Mixture-of-Agents Enhances Large Language Model Capabilities","venue":"cs.CL","work_id":"3efec870-3e92-4baa-be9f-50e1aa07140f","year":2024},"citing_paper":{"arxiv_id":"2605.01566","last_updated":"2026-05-02T18:31:02Z","snapshot_observed_at":"2026-07-06T23:14:47.444386Z","submitted_at":"2026-05-02T18:31:02Z","title":"Multi-Agent Reasoning Improves Compute Efficiency: Pareto-Optimal Test-Time Scaling","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-09T14:07:43.507761Z"},"links":{"cited_paper":"/paper/2406.04692","citing_paper":"/paper/2605.01566"},"observation_digest":"sha256:e2755e2fb436dd760256513a127b916ec60a7d232cb253c41ffdd93256296897","observation_id":"b205710e-600d-4d3e-b26c-2923fc9e67b3","resolution":{"observed_at":"2026-05-16T19:29:34.516338Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":"2203.11171","doi":"10.1101/2025.04.03.646459","metadata_source":"pith","pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","venue":"cs.CL","work_id":"8c6d5a6b-b5cc-4105-9c84-9c34bb9375bb","year":2022},"citing_paper":{"arxiv_id":"2605.01566","last_updated":"2026-05-02T18:31:02Z","snapshot_observed_at":"2026-07-06T23:14:47.444386Z","submitted_at":"2026-05-02T18:31:02Z","title":"Multi-Agent Reasoning Improves Compute Efficiency: Pareto-Optimal Test-Time Scaling","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-09T14:07:43.507761Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2605.01566"},"observation_digest":"sha256:a4e55c931625059569e6b28654ea769c13960b1f2f001607a3403159c95e24b6","observation_id":"42617628-578f-44d7-9742-9f36916819c3","resolution":{"observed_at":"2026-05-11T17:01:10.436307Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-05-21T18:52:42.88633+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T18:52:42.88633+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":"2201.11903","doi":"10.48550/arxiv.2201.11903","metadata_source":"pith","pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-07-10T21:57:37.821767Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","venue":"cs.CL","work_id":"d1cf6693-a082-403c-ada9-dac7b96341f9","year":2022},"citing_paper":{"arxiv_id":"2605.01566","last_updated":"2026-05-02T18:31:02Z","snapshot_observed_at":"2026-07-06T23:14:47.444386Z","submitted_at":"2026-05-02T18:31:02Z","title":"Multi-Agent Reasoning Improves Compute Efficiency: Pareto-Optimal Test-Time Scaling","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-09T14:07:43.507761Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2605.01566"},"observation_digest":"sha256:c006d6157380acbb93ae7c3f06343faa0da65a3050754073e09f27f5aa63d688","observation_id":"d8f3b0b5-94f1-4391-9da1-2a8cdff683a3","resolution":{"observed_at":"2026-05-11T17:01:10.429053Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:06.391775+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:06.391775+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00724","last_updated":"2025-03-03T07:53:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-01T17:16:04Z","title":"Inference Scaling Laws: An Empirical Analysis of Compute-Optimal Inference for Problem-Solving with Language Models","version":3},"cited_work":{"arxiv_id":"2408.00724","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.00724","snapshot_observed_at":"2026-07-04T11:09:46.442555Z","title":"Inference Scaling Laws: An Empirical Analysis of Compute-Optimal Inference for Problem-Solving with Language Models","venue":"cs.AI","work_id":"cef2c407-5d51-46a9-8eb6-f382b419502e","year":2024},"citing_paper":{"arxiv_id":"2605.01566","last_updated":"2026-05-02T18:31:02Z","snapshot_observed_at":"2026-07-06T23:14:47.444386Z","submitted_at":"2026-05-02T18:31:02Z","title":"Multi-Agent Reasoning Improves Compute Efficiency: Pareto-Optimal Test-Time Scaling","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-09T14:07:43.507761Z"},"links":{"cited_paper":"/paper/2408.00724","citing_paper":"/paper/2605.01566"},"observation_digest":"sha256:55f9afcb2819e2619c603ef33d181ed31812c5ab2edc0d2f2d9fcd716d2613aa","observation_id":"334b9a48-f8cd-4efd-8a9f-efb92cf0e7ad","resolution":{"observed_at":"2026-05-18T06:38:37.536547Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"FLOPs are calculated with the formulas from Table 4 of Appendix B","venue":null,"work_id":"577ad22f-9b4a-4367-bdd4-8ef34c7742de","year":2023},"citing_paper":{"arxiv_id":"2605.01566","last_updated":"2026-05-02T18:31:02Z","snapshot_observed_at":"2026-07-06T23:14:47.444386Z","submitted_at":"2026-05-02T18:31:02Z","title":"Multi-Agent Reasoning Improves Compute Efficiency: Pareto-Optimal Test-Time Scaling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-09T14:07:43.507761Z"},"links":{"citing_paper":"/paper/2605.01566"},"observation_digest":"sha256:201ffb8f548564bd9e5ec755f78211092be1d659ac316020b1b9651f6817a6a4","observation_id":"69bdb243-3903-40f2-b014-874be9a2d89a","resolution":{"observed_at":"2026-05-26T02:26:30.149968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"FLOPs are estimated by assuming that each parameter is used for one multiplication and one addition per token","venue":null,"work_id":"a683b4a5-6092-4da2-99cf-91a04f7f5602","year":2021},"citing_paper":{"arxiv_id":"2605.01566","last_updated":"2026-05-02T18:31:02Z","snapshot_observed_at":"2026-07-06T23:14:47.444386Z","submitted_at":"2026-05-02T18:31:02Z","title":"Multi-Agent Reasoning Improves Compute Efficiency: Pareto-Optimal Test-Time Scaling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-09T14:07:43.507761Z"},"links":{"citing_paper":"/paper/2605.01566"},"observation_digest":"sha256:1ce59ae6f9530e6d9fbe1e445c46ed4c7d0c24dd10c499f7e40cc07589d44010","observation_id":"37cc218c-9373-4643-a7c3-e62d04852c65","resolution":{"observed_at":"2026-05-26T02:26:30.146256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8e86e6eb-295f-4f90-bbd9-b8769ab201d5","year":2026},"citing_paper":{"arxiv_id":"2605.01566","last_updated":"2026-05-02T18:31:02Z","snapshot_observed_at":"2026-07-06T23:14:47.444386Z","submitted_at":"2026-05-02T18:31:02Z","title":"Multi-Agent Reasoning Improves Compute Efficiency: Pareto-Optimal Test-Time Scaling","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-09T14:07:43.507761Z"},"links":{"citing_paper":"/paper/2605.01566"},"observation_digest":"sha256:2e6a34d7d4f2282184db7fafec345434ec0b12da3d18b5dd9a5e5cabfe953265","observation_id":"8ca8adbe-9cf7-43b5-8ded-9f3a74a0f64d","resolution":{"observed_at":"2026-05-26T02:26:30.154013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-27T06:30:09.085275+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.01566","last_updated":"2026-05-02T18:31:02Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T23:14:47.444386Z","submitted_at":"2026-05-02T18:31:02Z","title":"Multi-Agent Reasoning Improves Compute Efficiency: Pareto-Optimal Test-Time Scaling"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":9,"parse_uncertain":0,"unresolved":0,"verified_exact":5,"verified_fuzzy":4},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-07-27T06:30:09.085275+00:00","source":"crossref"},{"observed_at":"2026-07-27T06:30:01.563335+00:00","source":"retraction_watch"}],"thesis":"As of 27 July 2026, this Paper Citation Record lists 18 of 18 outbound references and 1 inbound Pith citation observation for arXiv:2605.01566."}