{"as_of":"2026-08-04T19:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b6a1cb419d0bceda2b154f8cfd3058591a3ad421cfe3847be98fc03f77046300","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T04:42:23.297389Z","state":"measured"},{"denominator":172,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":172,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":211,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T18:37:58.924352Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T06:15:00.866473Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2405.16755","last_updated":"2024-11-25T19:43:07Z","snapshot_observed_at":"2026-08-02T16:46:24.597803Z","submitted_at":"2024-05-27T01:54:16Z","title":"CHESS: Contextual Harnessing for Efficient SQL Synthesis","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-19T11:24:22.789901Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2405.16755"},"observation_digest":"sha256:bb82c9772c2bef074042e5d3a9cc727c0ac73812835710f5f33a1a006a86c99e","observation_id":"38ac9a5b-c39f-47c9-9dea-bd142309e795","resolution":{"observed_at":"2026-05-19T11:24:22.871939Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2408.07199","last_updated":"2024-08-13T20:52:13Z","snapshot_observed_at":"2026-08-01T22:07:45.419539Z","submitted_at":"2024-08-13T20:52:13Z","title":"Agent Q: Advanced Reasoning and Learning for Autonomous AI Agents","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-20T09:41:59.979595Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2408.07199"},"observation_digest":"sha256:36e95ae1ca0bc8c0a60671175b770affad8333b5dbd8d9b7d7e0665407906af9","observation_id":"78ccfddf-94c0-4904-86b4-29391ecc23a4","resolution":{"observed_at":"2026-05-20T09:42:04.438573Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2412.08812","last_updated":"2026-04-19T16:29:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-11T23:02:26Z","title":"Test-Time Alignment via Hypothesis Reweighting","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-23T06:55:54.051821Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2412.08812"},"observation_digest":"sha256:70781f16ee30a8b30719526cf3f7b26b934d29de49717699d07fdc0f9326b762","observation_id":"6a1c049f-1c98-44dc-bebb-8b9b14308e8b","resolution":{"observed_at":"2026-05-23T06:57:40.521764Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2412.21139","last_updated":"2025-06-06T07:53:20Z","snapshot_observed_at":"2026-07-06T20:14:49.976782Z","submitted_at":"2024-12-30T18:15:39Z","title":"Training Software Engineering Agents and Verifiers with SWE-Gym","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T05:20:40.483057Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2412.21139"},"observation_digest":"sha256:1f8acc9162c993d702902fbe0fa361344cbe2e057b8d780592db59fd63e73a47","observation_id":"e02fa68a-bea8-412d-ae82-21615863d09c","resolution":{"observed_at":"2026-05-18T05:20:40.547823Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-05-13T15:51:29.022336Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2412.21187"},"observation_digest":"sha256:67fab3acca5ae5044440271295d3ed66f096950da6a86a054ffbcc199f588a4c","observation_id":"afdf5663-32e6-4087-a5a3-52335bf41784","resolution":{"observed_at":"2026-05-13T15:51:29.284994Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2501.09732","last_updated":"2025-01-16T18:30:37Z","snapshot_observed_at":"2026-07-06T20:22:04.328179Z","submitted_at":"2025-01-16T18:30:37Z","title":"Inference-Time Scaling for Diffusion Models beyond Scaling Denoising Steps","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T11:45:17.473970Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2501.09732"},"observation_digest":"sha256:55ecc067a0096e0773fc39cb633f981ebe585c960bcbb4830442e8bd660afb9c","observation_id":"4c855f7d-bda9-4723-81ba-38eea980c9b5","resolution":{"observed_at":"2026-05-20T11:45:17.534131Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"reference_index":300,"source":"arxiv_source","source_observed_at":"2026-05-17T02:11:36.932541Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2502.03387"},"observation_digest":"sha256:3ec9ac044870a55a2b4c8b90b365ab4b6d5073eb1105015e7e592d24888ccff2","observation_id":"95c0549f-7c96-4e10-b2c0-9317dc870a4d","resolution":{"observed_at":"2026-05-17T02:11:37.433307Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2502.10517","last_updated":"2025-02-14T19:30:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-14T19:30:53Z","title":"KernelBench: Can LLMs Write Efficient GPU Kernels?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T16:55:01.976356Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2502.10517"},"observation_digest":"sha256:04f039995fa5ba3b45ceb429ff7f6b9290a1ceab7e066bece3e0c3e0cf8ab95d","observation_id":"45b2a91c-5c90-4986-9026-190a6e4c4f2c","resolution":{"observed_at":"2026-05-15T16:55:02.056758Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-12T08:40:40.910461Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2503.09567"},"observation_digest":"sha256:f8ce4572d92142fef245f685a40c8ef0737dfdfc08d99cfbedd488e9965dcd67","observation_id":"b9e0604b-7a8f-4299-bb0e-f76cd839d51c","resolution":{"observed_at":"2026-05-12T08:40:41.231662Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2504.02181","last_updated":"2026-04-22T01:49:17Z","snapshot_observed_at":"2026-07-30T09:24:14.725185Z","submitted_at":"2025-04-02T23:51:27Z","title":"A Survey of Scaling in Large Language Model Reasoning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-22T21:20:07.238992Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2504.02181"},"observation_digest":"sha256:b5e0c292c7cc0b456a10216566e5f1370b956b0756817d30d638ca4d7a83ee74","observation_id":"8806c47c-1293-408d-aeb7-56ed79f389bf","resolution":{"observed_at":"2026-05-22T21:22:09.405178Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2504.12501","last_updated":"2026-08-03T01:47:58Z","snapshot_observed_at":"2026-08-04T19:24:41.090409Z","submitted_at":"2025-04-16T21:36:46Z","title":"Reinforcement Learning from Human Feedback","version":9},"reference_index":158,"source":"pdf_text","source_observed_at":"2026-05-22T19:27:40.991325Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2504.12501"},"observation_digest":"sha256:1d7adb0e80dd67a172c42a69c517d10c25a096766fb7550610e7580b22383bae","observation_id":"0df56234-770f-4480-a32b-20e782abdcbc","resolution":{"observed_at":"2026-05-22T19:32:00.997065Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2505.11737","last_updated":"2026-04-11T18:08:02Z","snapshot_observed_at":"2026-08-02T07:06:47.956538Z","submitted_at":"2025-05-16T22:47:32Z","title":"TokUR: Token-Level Uncertainty Estimation for Large Language Model Reasoning","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-22T13:58:07.913104Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2505.11737"},"observation_digest":"sha256:978ec619ca767332322f2feb696e35307ccc4267933145f11d15722eee9a9bcc","observation_id":"47a895d9-b95b-4eca-88bf-993bbd877579","resolution":{"observed_at":"2026-05-22T14:01:38.259150Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2507.14200","last_updated":"2026-05-15T13:08:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-14T16:17:11Z","title":"A Scalable Multi-LLM Collaboration System with Retrieval-based Selection and Exploration-Exploitation-Driven Enhancement","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-21T23:26:38.457193Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2507.14200"},"observation_digest":"sha256:b0fe67f71500c0be065448ea8b6bc69094004d2e365004afcc8883584050bf51","observation_id":"a0120f73-d4ed-493e-ac01-4e36f8328191","resolution":{"observed_at":"2026-05-21T23:30:46.154852Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2507.14958","last_updated":"2026-05-24T11:58:35Z","snapshot_observed_at":"2026-08-02T07:47:23.719127Z","submitted_at":"2025-07-20T13:36:19Z","title":"MUR: Momentum Uncertainty guided Reasoning for Large Language Models","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-19T03:34:06.058415Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2507.14958"},"observation_digest":"sha256:39593e22b3cbaf2237d700b953b3cfec82c03f25e6c257ad2c297b1c0f687701","observation_id":"bf8b2405-ace2-4d95-b09a-5b51c72c19b4","resolution":{"observed_at":"2026-05-19T03:37:01.282526Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2509.00084","last_updated":"2026-04-27T15:34:36Z","snapshot_observed_at":"2026-08-04T00:21:22.483235Z","submitted_at":"2025-08-27T06:51:48Z","title":"Learning to Refine: Self-Refinement of Parallel Reasoning in LLMs","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-18T21:16:15.703057Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2509.00084"},"observation_digest":"sha256:bf4b91005a5b9a06121706aefbc0210773093e8db6e4772918cec78850cb9499","observation_id":"29dc9182-7726-4091-a3d3-27e7ffb53b99","resolution":{"observed_at":"2026-05-18T21:16:50.917612Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2509.08827","last_updated":"2025-10-09T17:08:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-10T17:59:43Z","title":"A Survey of Reinforcement Learning for Large Reasoning Models","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-18T00:02:24.352947Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2509.08827"},"observation_digest":"sha256:e252c46e6f19bcc40d6ed588f960711babca94cd8aafb4fad5a9aed20ebb19a1","observation_id":"e511bb59-7b58-467d-9946-63fc080edb5c","resolution":{"observed_at":"2026-05-18T00:02:24.990480Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2509.09438","last_updated":"2026-04-07T04:24:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-11T13:25:40Z","title":"GrACE: A Generative Approach to Better Confidence Elicitation and Efficient Test-Time Scaling in Large Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T17:54:18.515174Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2509.09438"},"observation_digest":"sha256:0d02ab1354b341faa9b665bf2f110d7f93c0be87f4b97f4b41357126e64ed512","observation_id":"d076c677-f83b-4c5c-881a-3780e57bf923","resolution":{"observed_at":"2026-05-18T17:56:42.118255Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-04T18:37:58.924352Z","title":"Large language monkeys: Scaling inference compute with repeated sampling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09864","last_updated":"2025-09-11T21:35:19Z","snapshot_observed_at":"2026-08-04T18:37:58.637103Z","submitted_at":"2025-09-11T21:35:19Z","title":"Latency and Token-Aware Test-Time Compute","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T18:37:58.924352Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2509.09864"},"observation_digest":"sha256:923b7bb7c5bf3e44dd3b5094336b7036266588a1a006a59e981b8e16cbd6a3f0","observation_id":"653b2d7a-5096-4b02-a882-0c096d479b67","resolution":{"observed_at":"2026-08-04T18:37:58.924352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-04T17:56:38.736352Z","title":"Le, Christopher Ré, and Azalia Mirhoseini","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10397","last_updated":"2026-07-25T20:09:07Z","snapshot_observed_at":"2026-08-04T17:56:30.797902Z","submitted_at":"2025-09-12T16:44:34Z","title":"RecoWorld: Building Simulated Environments for Agentic Recommender Systems","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T17:56:38.736352Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2509.10397"},"observation_digest":"sha256:3d55b37a242145e2043b4de587b8ad8a5939fa27689086f82f307d492886c7a5","observation_id":"18e072a6-6f41-4819-aade-cff4ad1bc3c3","resolution":{"observed_at":"2026-08-04T17:56:38.736352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2509.19349","last_updated":"2025-09-17T17:49:02Z","snapshot_observed_at":"2026-08-04T18:42:43.786371Z","submitted_at":"2025-09-17T17:49:02Z","title":"ShinkaEvolve: Towards Open-Ended And Sample-Efficient Program Evolution","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-16T13:58:58.627748Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2509.19349"},"observation_digest":"sha256:3694aefe18b0a7a82d148fb6103ec5733449a7d93ce5b63418a8422047e63698","observation_id":"1b0abb2a-cf8e-409f-b150-3c045c92995f","resolution":{"observed_at":"2026-05-16T13:58:58.785856Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2509.21882","last_updated":"2026-05-25T20:11:55Z","snapshot_observed_at":"2026-08-04T14:57:15.491600Z","submitted_at":"2025-09-26T05:06:25Z","title":"Position: The Hidden Costs and Measurement Gaps of Reinforcement Learning with Verifiable Rewards","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-18T14:24:48.666197Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2509.21882"},"observation_digest":"sha256:aad1970cbdbd304b7312f1eebe76f5dc392f697794d1f034a6e48de8dd0db5cc","observation_id":"6fd22b96-fc10-4b38-99a6-3e155764ca5c","resolution":{"observed_at":"2026-05-18T14:26:28.250453Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-04T13:26:48.727277Z","title":"Federico Cassano, John Gouwar, Daniel Nguyen, Sydney Nguyen, Luna Phipps-Costin, Donald Pinckney, Ming-Ho Yee, Yangtian Zi, Carolyn Jane Anderson, Molly Q Feldman, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.00501","last_updated":"2026-06-22T13:28:57Z","snapshot_observed_at":"2026-08-04T13:26:47.762230Z","submitted_at":"2025-10-01T04:33:53Z","title":"CodeChemist: Functional Knowledge Transfer for Low-Resource Code Generation via Test-Time Scaling","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T13:26:48.727277Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2510.00501"},"observation_digest":"sha256:d7fa25c640214ca42c797aa432180f539b1d81dffbab15df3259265d1d082246","observation_id":"10f8765e-cbc9-49be-a9ae-60a4f5158b05","resolution":{"observed_at":"2026-08-04T13:26:48.727277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-04T13:23:15.338387Z","title":"arXiv:2407.21787 [cs] version: 1","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.01171","last_updated":"2026-07-15T22:07:56Z","snapshot_observed_at":"2026-08-04T13:23:08.839451Z","submitted_at":"2025-10-01T17:55:37Z","title":"Verbalized Sampling: How to Mitigate Mode Collapse and Unlock LLM Diversity","version":4},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T13:23:15.338387Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2510.01171"},"observation_digest":"sha256:07910e6fffdffd37544436f958bfe8dc99e81966cee810e54d639416150174a0","observation_id":"dd5b6225-4158-4808-8cb7-a59f9e2faa64","resolution":{"observed_at":"2026-08-04T13:23:15.338387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2510.04265","last_updated":"2026-05-12T01:55:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-05T16:14:03Z","title":"Don't Pass@k: A Bayesian Framework for Large Language Model Evaluation","version":4},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-18T10:04:39.223895Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2510.04265"},"observation_digest":"sha256:27998aa9daf1cbab7c15dfff2128890683ebacd9bd6e56c7483fa1fb41349896","observation_id":"f6448d16-2513-4886-a021-2069f652941f","resolution":{"observed_at":"2026-05-18T10:06:13.935739Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-04T11:20:11.793665Z","title":"Large language monkeys: Scaling inference compute with repeated sampling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.05681","last_updated":"2026-07-04T15:45:15Z","snapshot_observed_at":"2026-08-04T11:20:10.610981Z","submitted_at":"2025-10-07T08:38:08Z","title":"Verifier-free Test-Time Sampling for Vision-Language-Action Models","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T11:20:11.793665Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2510.05681"},"observation_digest":"sha256:5ced07d0230626969ecb584f11754f8f0df19d6e02450de885d4a0a4e049f87a","observation_id":"4467aa03-d89a-4cbe-a786-a69d2ce13618","resolution":{"observed_at":"2026-08-04T11:20:11.793665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2510.14232","last_updated":"2026-04-14T23:27:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T02:19:25Z","title":"Scaling Test-Time Compute to Achieve IOI Gold Medal with Open-Weight Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-18T06:20:16.941026Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2510.14232"},"observation_digest":"sha256:ed82c0786f0d2f331b0f9967c95c46c3ac232d6ef7214311ca9a40371280a238","observation_id":"56deccb5-b120-4d26-b2fb-e935d48405da","resolution":{"observed_at":"2026-05-18T06:20:58.247638Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2510.14703","last_updated":"2026-04-28T18:17:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-16T14:06:03Z","title":"ToolPRM: Fine-Grained Inference Scaling of Structured Outputs for Function Calling","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-18T06:30:39.858246Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2510.14703"},"observation_digest":"sha256:e2dda089434fee5064116bc20231c6067f65cd5e9bc388b3f872c8ce9d1cbf4e","observation_id":"2f60fb71-058a-46b4-b824-08f01e08b757","resolution":{"observed_at":"2026-05-18T06:30:59.534435Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2510.18117","last_updated":"2026-04-07T16:14:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-10-20T21:35:17Z","title":"Online In-Context Distillation for Low-Resource Vision Language Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T05:36:38.735914Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2510.18117"},"observation_digest":"sha256:7b47803308ef4e53a7184b95afe4a9b6717ebbda76e5907f7010eef486509782","observation_id":"62879cc6-03b5-4ef5-a491-8335c944821a","resolution":{"observed_at":"2026-05-18T05:40:55.938579Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2510.18245","last_updated":"2026-05-13T04:16:31Z","snapshot_observed_at":"2026-08-01T16:00:12.897969Z","submitted_at":"2025-10-21T03:08:48Z","title":"Scaling Laws Meet Model Architecture: Toward Inference-Efficient LLMs","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-18T05:30:11.389756Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2510.18245"},"observation_digest":"sha256:2d5f12f55f6d5417cf454d3c7e28ebb4b27e567d83990e97d52753b86abf1d31","observation_id":"3155b484-d3d6-4f13-9fd1-b30a2f9a2bf6","resolution":{"observed_at":"2026-05-18T05:30:55.104414Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-04T07:23:56.355587Z","title":"Large language monkeys: Scaling inference compute with repeated sampling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.26219","last_updated":"2026-06-03T00:59:51Z","snapshot_observed_at":"2026-08-04T07:23:55.106713Z","submitted_at":"2025-10-30T07:52:14Z","title":"Test-time reward-guided alignment of language models by importance sampling on pre-logit space","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T07:23:56.355587Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2510.26219"},"observation_digest":"sha256:fa3a372474ee931d5a8a476306827453fadbd594fb287322750b8a0d6fcc0ab9","observation_id":"56393672-9b42-44c7-b541-9d79aa696f0c","resolution":{"observed_at":"2026-08-04T07:23:56.355587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2511.19972","last_updated":"2026-05-07T02:58:13Z","snapshot_observed_at":"2026-07-06T22:36:53.831174Z","submitted_at":"2025-11-25T06:31:57Z","title":"Boosting Reasoning in Large Multimodal Models via Activation Replay","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-17T05:05:48.682057Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2511.19972"},"observation_digest":"sha256:7ccb747b681045c92c65132e1e5e3c8155f045f0ce2d06ac6ced9e5b94a49d95","observation_id":"608ec409-2c5b-440b-9db0-3c0dca7e880f","resolution":{"observed_at":"2026-05-17T05:09:04.022004Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2512.02304","last_updated":"2026-04-21T03:02:32Z","snapshot_observed_at":"2026-07-06T22:37:31.360740Z","submitted_at":"2025-12-02T00:51:14Z","title":"When Does Verification Pay Off? A Closer Look at LLMs as Solution Verifiers","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-17T03:05:30.630536Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2512.02304"},"observation_digest":"sha256:96431e8c98b6f1560114b864ab6e30a6c2a254275c5aeb7e475f0461edce29d2","observation_id":"a959d8dc-371b-4eaf-9045-0cc92350fdd8","resolution":{"observed_at":"2026-05-17T03:08:56.609424Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-03T07:05:16.719942Z","title":"1021/acs.jpclett.2c03055","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.21522","last_updated":"2026-06-06T17:02:11Z","snapshot_observed_at":"2026-08-03T07:05:11.933104Z","submitted_at":"2026-01-29T10:37:32Z","title":"More Bang for the Buck: Improving the Inference of Large Language Models at a Fixed Budget using Reset and Discard (ReD)","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-03T07:05:16.719942Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2601.21522"},"observation_digest":"sha256:5a7a447eee899097cf14f4d1b62f16cc736fc680725cdcd90f365ebd3dcc540a","observation_id":"c5669f28-ac3e-47bc-b2dc-143aec6542e0","resolution":{"observed_at":"2026-08-03T07:05:16.719942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2601.21619","last_updated":"2026-05-09T01:57:30Z","snapshot_observed_at":"2026-07-06T22:43:30.761426Z","submitted_at":"2026-01-29T12:22:45Z","title":"On the Overscaling Curse of Parallel Thinking: System Efficacy Contradicts Sample Efficiency","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T10:38:09.875786Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2601.21619"},"observation_digest":"sha256:704d9044abe789dcd425d4e8fa2f961f9df004ea8a21894c9e018659097e799c","observation_id":"27410b20-48b6-40ac-be67-0e610e3bf4a4","resolution":{"observed_at":"2026-05-16T10:40:51.380692Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-03T05:02:37.808045Z","title":"Brown, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.03466","last_updated":"2026-07-07T22:50:14Z","snapshot_observed_at":"2026-08-03T05:02:34.045420Z","submitted_at":"2026-02-03T12:41:25Z","title":"Quantum Circuit Generation via test-time learning with large language models","version":5},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T05:02:37.808045Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2602.03466"},"observation_digest":"sha256:7ee965395a10b0b2382993c47701f227e4715bf6c597bc4b0d9f15acbe7aa3ae","observation_id":"07d9e39a-6b7a-4190-b771-e3ae3af75e56","resolution":{"observed_at":"2026-08-03T05:02:37.808045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-03T04:44:07.199803Z","title":"V., Ré, C., and Mirhoseini, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.04344","last_updated":"2026-07-20T14:58:37Z","snapshot_observed_at":"2026-08-04T18:48:33.477307Z","submitted_at":"2026-02-04T09:13:08Z","title":"UnMaskFork: Test-Time Scaling for Masked Diffusion via Deterministic Action Branching","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-03T04:44:07.199803Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2602.04344"},"observation_digest":"sha256:3bedab5e4f986fed2da266d941405f8f9582ea2955fad048428ddeae929ef20d","observation_id":"0680ac6b-997a-4865-b503-12e2880a56b0","resolution":{"observed_at":"2026-08-03T04:44:07.199803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-03T03:21:13.836456Z","title":"V., R \\'e , C., and Mirhoseini, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.08503","last_updated":"2026-06-04T07:08:18Z","snapshot_observed_at":"2026-08-04T19:28:20.133578Z","submitted_at":"2026-02-09T10:55:13Z","title":"Learning Self-Correction in Vision-Language Models via Rollout Augmentation","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-03T03:21:13.836456Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2602.08503"},"observation_digest":"sha256:194a94d3f8e977a1d472bede639a435d6a722fd223719571ab2fb3d619888b96","observation_id":"57b51591-3107-47f4-aa48-85ae14a2c6fa","resolution":{"observed_at":"2026-08-03T03:21:13.836456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-03T03:04:43.301388Z","title":"Large language monkeys: Scaling inference compute with repeated sampling.arXiv preprint arXiv:2407.21787,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.09305","last_updated":"2026-06-28T18:13:37Z","snapshot_observed_at":"2026-08-03T07:10:48.024369Z","submitted_at":"2026-02-10T00:45:24Z","title":"Reward Modeling for Reinforcement Learning-Based LLM Reasoning: Design, Challenges, and Evaluation","version":2},"reference_index":1952,"source":"pdf_text","source_observed_at":"2026-08-03T03:04:43.301388Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2602.09305"},"observation_digest":"sha256:18a46dec6765da3d3e679a2be8de032218bb7d528f3653e802fb5c2ea16594a8","observation_id":"6dccd669-0ad9-4187-a9b4-839631256ee6","resolution":{"observed_at":"2026-08-03T03:04:43.301388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-13T23:28:12.790404Z","title":"Large language monkeys: Scaling inference compute with repeated sampling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.16867","last_updated":"2026-06-03T09:37:20Z","snapshot_observed_at":"2026-08-04T17:34:53.201310Z","submitted_at":"2026-03-17T17:59:51Z","title":"Efficient Reasoning on the Edge","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-13T23:28:12.790404Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2603.16867"},"observation_digest":"sha256:482e1c20b2b945ebf26c36d732d7a800555a5f5ff91c19001ad8596ee2dbc961","observation_id":"28f36b6c-47a4-484a-8758-80322b7c40bb","resolution":{"observed_at":"2026-07-13T23:28:12.790404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-13T16:39:08.710653Z","title":"Infrastruc- ture config shifts scores by∼6pp on Terminal-Bench 2.0","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.27843","last_updated":"2026-06-09T22:24:51Z","snapshot_observed_at":"2026-08-04T04:11:06.898902Z","submitted_at":"2026-03-29T19:59:00Z","title":"Empirical Bayes Estimation and Inference via Smooth Nonparametric Maximum Likelihood","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T16:39:08.710653Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2603.27843"},"observation_digest":"sha256:5bda9cbb1b181817935ef5aa72735c74856ddd447a5e5665933e562be9d46695","observation_id":"17b97f1c-07b8-469b-bcc1-a98c7385023b","resolution":{"observed_at":"2026-07-13T16:39:08.710653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2603.27844","last_updated":"2026-04-16T17:29:54Z","snapshot_observed_at":"2026-08-02T23:33:21.781457Z","submitted_at":"2026-03-29T20:05:18Z","title":"Model Capability Dominates: Inference-Time Optimization Lessons from AIMO 3","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-14T21:39:52.665864Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2603.27844"},"observation_digest":"sha256:077569d1c5036e7a3d6ab36f6715966e16ffb0b23401321f1e22f616ee311e9b","observation_id":"6cf7f79f-f1aa-4665-b6f0-3b8b17d30b3f","resolution":{"observed_at":"2026-05-14T21:43:00.817493Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2604.02547","last_updated":"2026-04-02T21:56:23Z","snapshot_observed_at":"2026-08-03T04:47:13.899796Z","submitted_at":"2026-04-02T21:56:23Z","title":"Beyond Resolution Rates: Behavioral Drivers of Coding Agent Success and Failure","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T20:30:40.124360Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2604.02547"},"observation_digest":"sha256:4c9671f410803b6f069a325a3a9376790201f41b5cb9986e28dcbb994fda32b7","observation_id":"77c1b623-db83-4944-9705-b465edb63b7f","resolution":{"observed_at":"2026-05-13T20:33:16.470385Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2604.03671","last_updated":"2026-04-04T09:52:30Z","snapshot_observed_at":"2026-08-02T07:25:05.287765Z","submitted_at":"2026-04-04T09:52:30Z","title":"User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T17:24:18.413112Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2604.03671"},"observation_digest":"sha256:bb27be36a4059210d2b29c904a62b5ef3f537e33d0bafd59d5ff9602fa14b832","observation_id":"308d31df-aaf2-4d81-b378-3aaff320362c","resolution":{"observed_at":"2026-05-13T17:28:02.579228Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-13T12:00:02.401705Z","title":"Large language monkeys: Scaling inference compute with repeated sampling.Arxiv Preprint Arxiv:2407.21787,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.03922","last_updated":"2026-07-12T05:30:15Z","snapshot_observed_at":"2026-07-16T23:18:41.605526Z","submitted_at":"2026-04-05T01:15:57Z","title":"ACES: Who Tests the Tests? Leave-One-Out AUC Consistency for Code Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T12:00:02.401705Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2604.03922"},"observation_digest":"sha256:b1cb27510d6ab7f6511488fc3a0d0bd8b5d34899bd69aea27fa17f441da55538","observation_id":"99aef33a-29e5-46fb-bc67-74f8f8ce572e","resolution":{"observed_at":"2026-07-13T12:00:02.401705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-14T19:54:08.600196Z","title":"Large language monkeys: Scaling inference compute with repeated sampling.Arxiv Preprint Arxiv:2407.21787,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.03922","last_updated":"2026-07-12T05:30:15Z","snapshot_observed_at":"2026-07-16T23:18:41.605526Z","submitted_at":"2026-04-05T01:15:57Z","title":"ACES: Who Tests the Tests? Leave-One-Out AUC Consistency for Code Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T19:54:08.600196Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2604.03922"},"observation_digest":"sha256:3c5c4834dcb42f2acf44d687ee9f06892730de275e9470f1fe99b3721512105a","observation_id":"9b67500c-1941-4499-9f6e-e181e8525835","resolution":{"observed_at":"2026-07-14T19:54:08.600196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-13T10:38:11.981408Z","title":"arXiv:2407.21787 [cs.LG] https://arxiv.org/abs/2407.21787","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.04236","last_updated":"2026-04-05T19:36:51Z","snapshot_observed_at":"2026-08-04T16:18:20.141337Z","submitted_at":"2026-04-05T19:36:51Z","title":"NEURA: A Unified and Retargetable Compilation Framework for Coarse-Grained Reconfigurable Architectures","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T10:38:11.981408Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2604.04236"},"observation_digest":"sha256:4a80a69251ca11a7a8acda2eedb8e95da6273dbb1a5f5e702ae59321861eb6ad","observation_id":"31a637e0-9c57-4c8c-9a87-bda3dcdae844","resolution":{"observed_at":"2026-07-13T10:38:11.981408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2604.09611","last_updated":"2026-03-12T10:10:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-03-12T10:10:37Z","title":"Characterizing Performance-Energy Trade-offs of Large Language Models in Multi-Request Workflows","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T12:28:38.809950Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2604.09611"},"observation_digest":"sha256:9543162d2c2fb468f101860ccb830b169c197903559e5881592de5d6c5656a8b","observation_id":"32fc1e19-a630-478d-a197-0f7b082d88bc","resolution":{"observed_at":"2026-05-15T12:30:00.219955Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2604.10449","last_updated":"2026-04-12T04:15:31Z","snapshot_observed_at":"2026-07-06T22:59:05.519456Z","submitted_at":"2026-04-12T04:15:31Z","title":"AdverMCTS: Combating Pseudo-Correctness in Code Generation via Adversarial Monte Carlo Tree Search","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-10T16:35:16.056397Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2604.10449"},"observation_digest":"sha256:b5812529dffdd7230fa0f8d7c7dff76a1c8e986f4ac134239a641e2f8ad39e52","observation_id":"bc4ff782-9677-4f31-9994-3891ebe39212","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2604.14853","last_updated":"2026-04-16T10:39:22Z","snapshot_observed_at":"2026-07-06T23:02:31.717911Z","submitted_at":"2026-04-16T10:39:22Z","title":"Adaptive Test-Time Compute Allocation for Reasoning LLMs via Constrained Policy Optimization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T11:57:44.680423Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2604.14853"},"observation_digest":"sha256:54b5be8780c8fb9ff68ac0dc9862848abe6dae044dbc264bfee26743008618c9","observation_id":"1ce9458f-11f1-4b7f-8686-07c95446b432","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2604.14877","last_updated":"2026-04-16T11:06:19Z","snapshot_observed_at":"2026-07-06T23:02:31.717911Z","submitted_at":"2026-04-16T11:06:19Z","title":"Does RL Expand the Capability Boundary of LLM Agents? A PASS@(k,T) Analysis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T11:49:31.930788Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2604.14877"},"observation_digest":"sha256:1dcfa2c70c0ccb318ff2fafe9637523f9a4c84e19a47402bd892b6fe5f41db87","observation_id":"605c0a8e-af7a-4ca1-8687-b52306e85234","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2604.15306","last_updated":"2026-04-16T17:59:43Z","snapshot_observed_at":"2026-07-06T23:02:53.677687Z","submitted_at":"2026-04-16T17:59:43Z","title":"Generalization in LLM Problem Solving: The Case of the Shortest Path","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T10:37:45.355872Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2604.15306"},"observation_digest":"sha256:6f8517b5ea61c9a3bfb7841b30eed0d7dc4fce14da4a70b317689949c63fb906","observation_id":"64097ce3-b95d-4556-bbb3-488369b1428f","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2604.17433","last_updated":"2026-06-04T22:58:20Z","snapshot_observed_at":"2026-08-02T14:45:34.175111Z","submitted_at":"2026-04-19T13:26:04Z","title":"Self-Consistency from Only Two Samples: CoT-PoT Ensembling for Efficient LLM Reasoning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-10T05:40:25.414166Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2604.17433"},"observation_digest":"sha256:35d15456ebffa330b6e5526babf68a80e8f0d24296b8ad4c99740a82239eabd5","observation_id":"be582e88-0179-447b-bd2d-8ff2c2af6939","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2604.17614","last_updated":"2026-04-19T20:58:25Z","snapshot_observed_at":"2026-08-01T22:49:57.966435Z","submitted_at":"2026-04-19T20:58:25Z","title":"Characterizing Model-Native Skills","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-05-10T05:42:49.694715Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2604.17614"},"observation_digest":"sha256:6a2a417f07ef93bfa7f33dc321810b0d7ae75be2d56bcbe0ba809d3321123615","observation_id":"f8ff64d7-89c7-4291-92ef-27bdd8c13dac","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2604.17928","last_updated":"2026-04-20T08:09:01Z","snapshot_observed_at":"2026-07-06T23:04:55.190916Z","submitted_at":"2026-04-20T08:09:01Z","title":"HEALing Entropy Collapse: Enhancing Exploration in Few-Shot RLVR via Hybrid-Domain Entropy Dynamics Alignment","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-05-10T05:23:08.478393Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2604.17928"},"observation_digest":"sha256:5234cb55278b611f5f7298fba9eed5141cec8b324503f398b702a7d16cfa64ad","observation_id":"98968f63-ff56-4606-9d98-e810c0cc8a2b","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2604.19341","last_updated":"2026-04-21T11:24:09Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T11:24:09Z","title":"Evaluation-driven Scaling for Scientific Discovery","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T03:39:52.204043Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2604.19341"},"observation_digest":"sha256:ac5da7fe1eecbec760921aefe613ebb85c7b4cfa022d4356aed5353ed5b4f43b","observation_id":"08c59f07-4256-4cff-9239-6b413d11ccf7","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2604.21018","last_updated":"2026-04-22T19:07:29Z","snapshot_observed_at":"2026-07-06T23:07:41.856444Z","submitted_at":"2026-04-22T19:07:29Z","title":"Adaptive Test-Time Compute Allocation with Evolving In-Context Demonstrations","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-09T23:55:50.606359Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2604.21018"},"observation_digest":"sha256:e40baf9e106a202c987700bf220036bc3e83a8a0074a9e0eee8084bb5d2bcb95","observation_id":"a22f4059-571a-400f-a5cc-14fff9ec0f5f","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2604.22212","last_updated":"2026-04-24T04:30:02Z","snapshot_observed_at":"2026-07-06T23:08:37.811548Z","submitted_at":"2026-04-24T04:30:02Z","title":"Multimodal Diffusion to Mutually Enhance Polarized Light and Low Resolution EBSD Data","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T09:27:46.993773Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2604.22212"},"observation_digest":"sha256:21cb8c2c4306fd88a2fa6923e857e006602dc428af5022f168a23656a8f322a9","observation_id":"8b20ff34-b072-465c-9406-9b0a593dfc88","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2604.24037","last_updated":"2026-06-22T01:13:01Z","snapshot_observed_at":"2026-07-06T23:10:12.016186Z","submitted_at":"2026-04-27T04:43:42Z","title":"A Limit Theory of Foundation Models: A Mathematical Approach to Understanding Emergent Intelligence and Scaling Laws","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-13T07:27:21.118156Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2604.24037"},"observation_digest":"sha256:7d3fdb131cd6c4d110d69dfcd283942356240aaaf925064f6530bbe383e79507","observation_id":"7265e842-3b1d-4b8f-a11a-805e35a62da3","resolution":{"observed_at":"2026-05-13T07:27:29.030185Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2604.24037","last_updated":"2026-06-22T01:13:01Z","snapshot_observed_at":"2026-07-06T23:10:12.016186Z","submitted_at":"2026-04-27T04:43:42Z","title":"A Limit Theory of Foundation Models: A Mathematical Approach to Understanding Emergent Intelligence and Scaling Laws","version":4},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-07-01T09:03:59.522516Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2604.24037"},"observation_digest":"sha256:b45adb8204122f8acdd2171d606318c07c0da4fb5b881182469dd99c489bca52","observation_id":"410ec51e-f73f-4e76-95af-182fdd31f0bd","resolution":{"observed_at":"2026-07-01T09:05:36.312186Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.02427","last_updated":"2026-05-11T20:46:44Z","snapshot_observed_at":"2026-07-06T23:15:32.349713Z","submitted_at":"2026-05-04T10:26:34Z","title":"The Model Knows, the Decoder Finds: Future Value Guided Particle Power Sampling","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-08T18:58:22.865080Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.02427"},"observation_digest":"sha256:a0313bf461f1428f39732d0307b98869df46e0623ca973d397fdd5d4c04e54cc","observation_id":"8023d7c5-623e-4bd9-8c1a-cec06b5bb72e","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.02427","last_updated":"2026-05-11T20:46:44Z","snapshot_observed_at":"2026-07-06T23:15:32.349713Z","submitted_at":"2026-05-04T10:26:34Z","title":"The Model Knows, the Decoder Finds: Future Value Guided Particle Power Sampling","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-13T02:14:17.870184Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.02427"},"observation_digest":"sha256:9b8075ff67288645065574d970a82d62ac4cdab772dfe78826bdc51526b6921e","observation_id":"90dc27af-41c8-4635-ae12-27e362ea1df1","resolution":{"observed_at":"2026-05-13T02:17:06.617272Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.03065","last_updated":"2026-06-26T00:04:01Z","snapshot_observed_at":"2026-07-06T23:16:00.796105Z","submitted_at":"2026-05-04T18:36:40Z","title":"OGPO: Sample Efficient Full-Finetuning of Generative Control Policies","version":1},"reference_index":138,"source":"arxiv_source","source_observed_at":"2026-05-08T18:48:56.075160Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.03065"},"observation_digest":"sha256:371423f1efce1f62995bc527d3933ad5fc02ce67f813079727d9353f9cb5ed32","observation_id":"0a01fca9-3de4-479d-9c90-19662e9c06e3","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.03065","last_updated":"2026-06-26T00:04:01Z","snapshot_observed_at":"2026-07-06T23:16:00.796105Z","submitted_at":"2026-05-04T18:36:40Z","title":"OGPO: Sample Efficient Full-Finetuning of Generative Control Policies","version":4},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-01T00:02:55.449923Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.03065"},"observation_digest":"sha256:7130245985eb0224e320a7a33e0281e704bd326f486b09ee16550b2e6a00e903","observation_id":"8d89a0db-29e9-447b-acf6-4dc613ddc45c","resolution":{"observed_at":"2026-07-01T00:05:09.681731Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.03379","last_updated":"2026-05-07T02:23:28Z","snapshot_observed_at":"2026-07-06T23:16:20.322265Z","submitted_at":"2026-05-05T05:40:09Z","title":"Two Calls, Two Moments, and the Vote-Accuracy Curve of Repeated LLM Inference","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-07T17:24:50.376330Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.03379"},"observation_digest":"sha256:addc1fbb8b40071e377939fe1123c9358c593ecb11ef792b9cd76175e4dc7e3d","observation_id":"3f937544-49b7-4511-9e97-22064581c88c","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.03379","last_updated":"2026-05-07T02:23:28Z","snapshot_observed_at":"2026-07-06T23:16:20.322265Z","submitted_at":"2026-05-05T05:40:09Z","title":"Two Calls, Two Moments, and the Vote-Accuracy Curve of Repeated LLM Inference","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T18:42:24.796800Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.03379"},"observation_digest":"sha256:90ecb75485b462e6973fc19cb2042b4fe13eb5e2411f923ae3317b1f460373a3","observation_id":"4a98ca04-b7f7-4d6b-962a-19d0daea27ca","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.04236","last_updated":"2026-05-14T11:54:24Z","snapshot_observed_at":"2026-07-06T23:17:04.200299Z","submitted_at":"2026-05-05T19:24:10Z","title":"Adaptive Consensus in LLM Ensembles via Sequential Evidence Accumulation: Automatic Budget Identification and Calibrated Commit Signals","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-08T19:00:45.357979Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.04236"},"observation_digest":"sha256:9ce2cde9dcad9540d9829316429f7fd6aed457994251bfaf485694014b15ec97","observation_id":"2a7ed87e-f42a-4b0c-b924-fa369785ad70","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.04236","last_updated":"2026-05-14T11:54:24Z","snapshot_observed_at":"2026-07-06T23:17:04.200299Z","submitted_at":"2026-05-05T19:24:10Z","title":"Adaptive Consensus in LLM Ensembles via Sequential Evidence Accumulation: Automatic Budget Identification and Calibrated Commit Signals","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-15T06:44:52.701064Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.04236"},"observation_digest":"sha256:fa8e37d6f85b8efdf87ce2df260f40989f8e3d63a99052c35b4597e8353dfd2e","observation_id":"f7c8e287-d759-4007-915a-610a8a642a3a","resolution":{"observed_at":"2026-05-15T06:45:10.867621Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.04831","last_updated":"2026-05-06T12:28:17Z","snapshot_observed_at":"2026-07-06T23:17:33.252539Z","submitted_at":"2026-05-06T12:28:17Z","title":"StoryAlign: Evaluating and Training Reward Models for Story Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T17:29:13.549559Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.04831"},"observation_digest":"sha256:8ac7468aca0cb0e516b2120aefe5d32d6e11586a663e8783b53f5508f38eb8f4","observation_id":"4470974a-34f7-43ee-b112-b21e7bfb9516","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.05592","last_updated":"2026-05-07T02:21:38Z","snapshot_observed_at":"2026-07-06T23:18:12.631820Z","submitted_at":"2026-05-07T02:21:38Z","title":"When Can Voting Help, Hurt, or Change Course? Exact Structure of Binary Test-Time Aggregation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-09T15:48:43.002203Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.05592"},"observation_digest":"sha256:5f7a3f69bcb641786b9054bc458e90348fd796b2aabf08e819098937554ed9e2","observation_id":"5e7b6905-c191-49dc-b33a-6a8a3182f230","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.06116","last_updated":"2026-05-07T12:26:56Z","snapshot_observed_at":"2026-08-02T23:05:12.532363Z","submitted_at":"2026-05-07T12:26:56Z","title":"Policy-Guided Stepwise Model Routing for Cost-Effective Reasoning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T10:29:23.538806Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.06116"},"observation_digest":"sha256:de3197f86d067ecdb70b8afa206a0a39ed42e48a2e329cb47cba3b46f8168f42","observation_id":"ac33e29e-38dd-4316-8955-6eb77df12aee","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.06219","last_updated":"2026-05-07T13:17:13Z","snapshot_observed_at":"2026-08-02T22:17:25.170358Z","submitted_at":"2026-05-07T13:17:13Z","title":"Joint Consistency: A Unified Test-Time Aggregation Framework via Energy Minimization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T10:07:38.689197Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.06219"},"observation_digest":"sha256:af83189a8a59311b5cd60f6283331616bc78089b448f4b1cbd13e28289b31d5d","observation_id":"83cdb0f9-6b8b-40a4-968a-6688b1af6000","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.06785","last_updated":"2026-05-12T15:55:34Z","snapshot_observed_at":"2026-07-06T23:19:10.574595Z","submitted_at":"2026-05-07T18:00:04Z","title":"Distributional Process Reward Models: Calibrated Prediction of Future Rewards via Conditional Optimal Transport","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-11T01:17:01.225189Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.06785"},"observation_digest":"sha256:274630dfb158663507e2227aaf4e451a808761eab1305f7a4f5e77be45a33611","observation_id":"01909d98-c5ca-4570-afc6-53eec91621db","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.06785","last_updated":"2026-05-12T15:55:34Z","snapshot_observed_at":"2026-07-06T23:19:10.574595Z","submitted_at":"2026-05-07T18:00:04Z","title":"Distributional Process Reward Models: Calibrated Prediction of Future Rewards via Conditional Optimal Transport","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T06:27:19.650539Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.06785"},"observation_digest":"sha256:ee8f4bdf3cbc0479f890fa8e47032b9c415641adda09ac818a54964e24833e29","observation_id":"d0b1e979-cc0b-482d-a8c3-f43957aeee39","resolution":{"observed_at":"2026-05-13T06:27:24.214659Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.06914","last_updated":"2026-05-07T20:23:32Z","snapshot_observed_at":"2026-08-02T05:38:27.537862Z","submitted_at":"2026-05-07T20:23:32Z","title":"Regulating Branch Parallelism in LLM Serving","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-11T01:00:53.308946Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.06914"},"observation_digest":"sha256:7f61e6dc40020b02c9b281db94982f95f05edc7f97cd24c8a67fe16ddf9ebb72","observation_id":"be1583af-297c-4b0d-9f0b-5ecbbfd9dd07","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.07137","last_updated":"2026-05-08T02:13:33Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T02:13:33Z","title":"Adaptive Negative Reinforcement for LLM Reasoning:Dynamically Balancing Correction and Diversity in RLVR","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-11T01:46:46.055118Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.07137"},"observation_digest":"sha256:d0bfcac19c01e8dc26c4f3574477cae7979ab3a3ecc8cdc31b86df19923ab2dc","observation_id":"56b8109c-f7b8-4b43-a603-84147d0dc06c","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.07153","last_updated":"2026-05-08T02:40:12Z","snapshot_observed_at":"2026-08-02T20:55:17.102521Z","submitted_at":"2026-05-08T02:40:12Z","title":"Beyond Reasoning: Reinforcement Learning Unlocks Parametric Knowledge in LLMs","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-11T01:26:21.545889Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.07153"},"observation_digest":"sha256:1331497691798cb134c0c0d48e029750cc1ebaad40146b4ae476150526f6e84b","observation_id":"498b651c-f698-4253-9efa-859bb5a00bad","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.08083","last_updated":"2026-05-12T03:46:05Z","snapshot_observed_at":"2026-07-06T23:20:19.821342Z","submitted_at":"2026-05-08T17:59:40Z","title":"LLMs Improving LLMs: Agentic Discovery for Test-Time Scaling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:34.000216Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.08083"},"observation_digest":"sha256:7948d0c59cd1c8cf619ebbce1115fd97cdf0fc88690029285ee5231a8dc2d8e6","observation_id":"81c61eb8-d208-4717-a669-e6e4db75ad66","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.08083","last_updated":"2026-05-12T03:46:05Z","snapshot_observed_at":"2026-07-06T23:20:19.821342Z","submitted_at":"2026-05-08T17:59:40Z","title":"LLMs Improving LLMs: Agentic Discovery for Test-Time Scaling","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-13T07:09:02.672233Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.08083"},"observation_digest":"sha256:412c333add97b6437d80b9571a80677423ddef8ed8cea8c8a9030e19b983f50f","observation_id":"56d1064f-5ad0-4b0d-94eb-30a0301b30c9","resolution":{"observed_at":"2026-05-13T07:12:28.305517Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.08478","last_updated":"2026-05-08T20:53:51Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T20:53:51Z","title":"When Independent Sampling Outperforms Agentic Reasoning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-12T02:46:48.375901Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.08478"},"observation_digest":"sha256:1731814241d6fb81c9ec4f297b4a9fd7d36833ac5f0bfb0196bd71964322d650","observation_id":"fa1cc8bb-f814-45f7-888d-077838fbb441","resolution":{"observed_at":"2026-05-12T07:31:24.608406Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.08696","last_updated":"2026-07-31T21:33:57Z","snapshot_observed_at":"2026-08-04T19:17:17.102706Z","submitted_at":"2026-05-09T05:07:55Z","title":"Structured Recurrent Mixers for Massively Parallelized Sequence Generation","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-12T01:28:46.885635Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.08696"},"observation_digest":"sha256:d929be4f9a9cc4e085c0ec13f45e075e800e01b8dd29600e8ad193f962ae6bde","observation_id":"5542b9dc-a293-4adb-83d3-d37f6e8533e7","resolution":{"observed_at":"2026-05-12T07:56:29.253728Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.08696","last_updated":"2026-07-31T21:33:57Z","snapshot_observed_at":"2026-08-04T19:17:17.102706Z","submitted_at":"2026-05-09T05:07:55Z","title":"Structured Recurrent Mixers for Massively Parallelized Sequence Generation","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-20T23:27:20.754475Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.08696"},"observation_digest":"sha256:4053517e1b017838feadbbee93630ba509edeecea0dbbe08acf85ca60d722610","observation_id":"740d9112-b9d4-40b5-8547-8feacd4ecfb3","resolution":{"observed_at":"2026-05-20T23:29:12.997662Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.08696","last_updated":"2026-07-31T21:33:57Z","snapshot_observed_at":"2026-08-04T19:17:17.102706Z","submitted_at":"2026-05-09T05:07:55Z","title":"Structured Recurrent Mixers for Massively Parallelized Sequence Generation","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-30T23:31:48.469869Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.08696"},"observation_digest":"sha256:cdf8b4086ad63cbf5c42df96ef57668bbb4bbb536b8913ee2724540416a2eabd","observation_id":"833a4051-0639-489f-a83a-63af4d89618b","resolution":{"observed_at":"2026-06-30T23:35:07.279844Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-04T05:19:06.275508Z","title":"Le, Christopher Ré, and Azalia Mirhoseini","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.08696","last_updated":"2026-07-31T21:33:57Z","snapshot_observed_at":"2026-08-04T19:17:17.102706Z","submitted_at":"2026-05-09T05:07:55Z","title":"Structured Recurrent Mixers for Massively Parallelized Sequence Generation","version":4},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T05:19:06.275508Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.08696"},"observation_digest":"sha256:f14373fa07dbb919f3bb0af26f055890ce53b475e4af167d9be83fdd51b1d5ba","observation_id":"09bb1549-59fb-41a6-9da0-3f1e049d0fdd","resolution":{"observed_at":"2026-08-04T05:19:06.275508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.08735","last_updated":"2026-05-09T06:39:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-09T06:39:17Z","title":"CollabVR: Collaborative Video Reasoning with Vision-Language and Video Generation Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-12T02:17:30.227755Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.08735"},"observation_digest":"sha256:a612a0ec1ae6d04226ef06fc4414edd80c86728c9626020f3d12a9aea290a8da","observation_id":"cfa4ad9c-d8b9-46e6-aec3-895d39bdf0fa","resolution":{"observed_at":"2026-05-12T07:41:47.162344Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.09492","last_updated":"2026-05-20T15:55:09Z","snapshot_observed_at":"2026-07-06T23:21:35.327066Z","submitted_at":"2026-05-10T11:57:39Z","title":"APCD: Adaptive Path-Contrastive Decoding for Reliable Large Language Model Generation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-12T05:22:25.475956Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.09492"},"observation_digest":"sha256:c09301a7bd588da6f1359effcfb7b4f968d7fac46b5b842a17efb029d53656aa","observation_id":"f55b6dca-5240-45b9-a146-e56ae2f682e0","resolution":{"observed_at":"2026-05-12T05:26:25.219380Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.09923","last_updated":"2026-05-13T06:42:03Z","snapshot_observed_at":"2026-07-06T23:21:59.096464Z","submitted_at":"2026-05-11T03:19:04Z","title":"expo: Exploration-prioritized policy optimization via adaptive kl regulation and gaussian curriculum sampling","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-12T04:20:30.301154Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.09923"},"observation_digest":"sha256:d389b4af8bef20a01ce951a8fc9752d8614a45e3b87dd3ed01874b5eeb2df9c3","observation_id":"659d6fac-1e03-489c-827e-d9816e8b83dd","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.10158","last_updated":"2026-05-11T08:05:27Z","snapshot_observed_at":"2026-08-01T00:58:04.704225Z","submitted_at":"2026-05-11T08:05:27Z","title":"Unsupervised Process Reward Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-12T03:19:04.275069Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.10158"},"observation_digest":"sha256:89cbbd159b29690de8ef4976ba3f062ef29abff16c4d166546e50460874d6ca4","observation_id":"51baad98-4fc4-479d-b33f-1817ed166cf3","resolution":{"observed_at":"2026-05-12T04:42:23.872588Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.10195","last_updated":"2026-05-14T07:42:56Z","snapshot_observed_at":"2026-08-03T09:42:12.047946Z","submitted_at":"2026-05-11T08:45:17Z","title":"Breaking the Reward Barrier: Accelerating Tree-of-Thought Reasoning via Speculative Exploration","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-12T03:51:52.375703Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.10195"},"observation_digest":"sha256:0dfb0ffb5d147ae271ffbfbfbeb1f86ddb0244ed419fd65134800f8d9d04af32","observation_id":"0cac4af2-53b2-42e6-81af-74a5919b52d1","resolution":{"observed_at":"2026-05-12T06:51:29.961691Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.10195","last_updated":"2026-05-14T07:42:56Z","snapshot_observed_at":"2026-08-03T09:42:12.047946Z","submitted_at":"2026-05-11T08:45:17Z","title":"Breaking the Reward Barrier: Accelerating Tree-of-Thought Reasoning via Speculative Exploration","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T05:11:32.053440Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.10195"},"observation_digest":"sha256:99fd2d55828736a5771a98053b04f42ec40779e36fd84a15e368b3278950ff6b","observation_id":"d10d4a83-28b0-4825-8144-e42c2d7e8fd7","resolution":{"observed_at":"2026-05-15T05:15:03.419678Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.10716","last_updated":"2026-05-11T15:25:29Z","snapshot_observed_at":"2026-07-06T23:22:37.355450Z","submitted_at":"2026-05-11T15:25:29Z","title":"What should post-training optimize? A test-time scaling law perspective","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T05:20:18.754351Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.10716"},"observation_digest":"sha256:b358309153832ab88ab4166bf4e0b90aef173141519922e48a333d051becd92d","observation_id":"315298f3-639e-4e68-a6f8-a20da24afd34","resolution":{"observed_at":"2026-05-12T05:21:23.941431Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.11374","last_updated":"2026-05-30T04:34:48Z","snapshot_observed_at":"2026-08-03T02:37:20.779106Z","submitted_at":"2026-05-12T00:56:34Z","title":"Test-Time Compute for Frozen Embedding Models through Agentic Program Search","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-13T02:29:11.167251Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.11374"},"observation_digest":"sha256:a73c185dd664e556949792bd2118ad4f8558d8e3d2ba2ca39199a2a52ef308e5","observation_id":"ae2415c4-0c83-46c4-ac21-3bc1103c3937","resolution":{"observed_at":"2026-05-13T02:32:06.495769Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.11374","last_updated":"2026-05-30T04:34:48Z","snapshot_observed_at":"2026-08-03T02:37:20.779106Z","submitted_at":"2026-05-12T00:56:34Z","title":"Test-Time Compute for Frozen Embedding Models through Agentic Program Search","version":5},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-30T22:12:25.941425Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.11374"},"observation_digest":"sha256:dbc41b674a17a6a33b26e91621570751b28183af69775bc225df28dc56a5997a","observation_id":"30d887a1-ba57-4c3e-962b-1727ea9ea960","resolution":{"observed_at":"2026-07-01T14:15:46.599329Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.11403","last_updated":"2026-05-12T01:48:48Z","snapshot_observed_at":"2026-07-06T23:23:16.461539Z","submitted_at":"2026-05-12T01:48:48Z","title":"fg-expo: Frontier-guided exploration-prioritized policy optimization via adaptive kl and gaussian curriculum","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T03:06:51.437906Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.11403"},"observation_digest":"sha256:b98532663975ac4754e2e995ac1ad90909a0c17e82c8ec5493c140bf2fcd90c8","observation_id":"36e51ee8-8b40-49e7-a6fa-05904a49d936","resolution":{"observed_at":"2026-05-13T03:07:08.619458Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.11484","last_updated":"2026-06-08T03:31:54Z","snapshot_observed_at":"2026-08-02T18:52:25.339873Z","submitted_at":"2026-05-12T04:02:03Z","title":"Engagement Process: Rethinking the Temporal Interface of Action and Observation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-13T01:37:31.252556Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.11484"},"observation_digest":"sha256:b6a7544218a2a6cc0bee47bebd5aeef0b432339882c88c53a2d019b35f56462e","observation_id":"36533d42-fb33-4c90-a69a-d2e0c8ec4e82","resolution":{"observed_at":"2026-05-13T01:42:04.027252Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.11484","last_updated":"2026-06-08T03:31:54Z","snapshot_observed_at":"2026-08-02T18:52:25.339873Z","submitted_at":"2026-05-12T04:02:03Z","title":"Engagement Process: Rethinking the Temporal Interface of Action and Observation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-30T22:40:05.658212Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.11484"},"observation_digest":"sha256:8984deb721f9bdba1615d41016fe84504d3d98e046a601ae4a0cd3cb20d2abbf","observation_id":"5adff99d-2f60-4714-a043-13558a4711a1","resolution":{"observed_at":"2026-07-01T13:45:46.520551Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.11625","last_updated":"2026-05-12T06:51:31Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:51:31Z","title":"Nice Fold or Hero Call: Learning Budget-Efficient Thinking for Adaptive Reasoning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T01:31:21.377700Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.11625"},"observation_digest":"sha256:9a92166d49919c31e5ced629a718218f87ce02432f2c24fd4e06226eaedde507","observation_id":"4f05ebe1-9692-46b4-8a01-1b02a03589cf","resolution":{"observed_at":"2026-05-13T01:32:02.691302Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.12620","last_updated":"2026-05-12T18:08:24Z","snapshot_observed_at":"2026-08-03T11:10:25.959236Z","submitted_at":"2026-05-12T18:08:24Z","title":"Think Twice, Act Once: Verifier-Guided Action Selection For Embodied Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-14T21:04:05.443622Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.12620"},"observation_digest":"sha256:69b891e7aa46bbaf4ea214912e50a15b73e68213e9ac72d85842a0dd49b6e8ee","observation_id":"95ab02fb-9168-41e1-881d-4e5ab2938e0e","resolution":{"observed_at":"2026-05-14T21:19:28.912168Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-03T02:22:14.631615Z","title":"Le, Christopher Ré, and Azalia Mirhoseini","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.15100","last_updated":"2026-07-31T12:11:10Z","snapshot_observed_at":"2026-08-04T19:11:02.399268Z","submitted_at":"2026-05-14T17:19:37Z","title":"Dual-Dimensional Consistency: Balancing Budget and Quality in Adaptive Inference-Time Scaling","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T02:22:14.631615Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.15100"},"observation_digest":"sha256:16f9ae522f5bc9d032e9f03b1f61fd05fc6ecb805436ed77a80b45ec525b4690","observation_id":"e4661eb8-8f09-4b6e-a894-492cadb26f56","resolution":{"observed_at":"2026-08-03T02:22:14.631615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.15177","last_updated":"2026-05-17T19:31:24Z","snapshot_observed_at":"2026-07-06T23:26:32.979566Z","submitted_at":"2026-05-14T17:57:40Z","title":"OpenDeepThink: Parallel Reasoning via Bradley-Terry Aggregation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T03:06:54.507594Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.15177"},"observation_digest":"sha256:e5fea071c616435337fadc74f503540e65217d3177b7ac8b302f487c58037b63","observation_id":"5a0c60c8-c71d-46f1-90a1-8e0a44e06a0f","resolution":{"observed_at":"2026-05-15T03:08:58.386020Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.15177","last_updated":"2026-05-17T19:31:24Z","snapshot_observed_at":"2026-07-06T23:26:32.979566Z","submitted_at":"2026-05-14T17:57:40Z","title":"OpenDeepThink: Parallel Reasoning via Bradley-Terry Aggregation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-20T20:51:47.393589Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.15177"},"observation_digest":"sha256:35001dcc42e6ecccf861ef0793ce8b89d5b49474258b1b1215114915c1b6912d","observation_id":"8927fb4c-180b-402c-9873-a9e0816d3a21","resolution":{"observed_at":"2026-05-20T20:53:43.615016Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2407.21787/citation-record","integrity":"/paper/2407.21787/integrity","json":"/paper/2407.21787/citation-record.json","paper":"/paper/2407.21787"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"URL https://aide.dev/","venue":null,"work_id":"32e0a68a-6223-434c-875a-950bb6ecb673","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:94af3e3d2d9420cae6a80772920d45628351703d4f2799917953e874f4a8e472","observation_id":"27233742-e9e2-4cfa-98d0-c81cce0eeaab","resolution":{"observed_at":"2026-05-12T04:42:23.871398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"URL https://openai.com/index/hello-gpt-4o/","venue":null,"work_id":"caf3e378-1f89-4117-bf7b-a70a340ba435","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:e6fb44bfd3e4a0dc7bf11a2c85c38207565410b74560bbcf28b89130efc2b75f","observation_id":"d1f44d38-59ef-4b16-9ccd-5d47cf4bf556","resolution":{"observed_at":"2026-05-12T04:42:23.708148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"URL https://llama.meta.com/llama3/","venue":null,"work_id":"fcec34f7-4120-4464-a668-68b13f570ef3","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:317140bf1f08b526656caa4c948e3156c8c1ca4bcad17f6eb0641ea96b307232","observation_id":"08fec5c2-02c0-4ecc-a838-540fbfea8aa2","resolution":{"observed_at":"2026-05-12T04:42:23.722600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"URL https://www.anthropic.com/news/claude-3-5-sonnet","venue":null,"work_id":"026d63d0-cf0d-4504-9ef7-99acc9cfd456","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:ec23f2296e0b59702a061a5c0658e2e75074c25a91c2522ec544baf3f941dca2","observation_id":"7325199c-bc25-4002-9ff2-35249ebed8a2","resolution":{"observed_at":"2026-05-12T04:42:23.727549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"URL https://www.voyageai.com/","venue":null,"work_id":"c2e9efed-6874-4350-9617-47d981771823","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:48265b7c695ab1733c97a4d8e46a9d5c0ba6f3988cd46e041aad35a26377850d","observation_id":"0d7cd5e0-b5fc-4d58-ae8b-f33972ac3ed9","resolution":{"observed_at":"2026-05-12T04:42:23.736137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08845","last_updated":"2024-07-11T20:07:30Z","snapshot_observed_at":"2026-07-06T17:44:12.972220Z","submitted_at":"2024-03-13T16:30:57Z","title":"Bifurcated Attention: Accelerating Massively Parallel Decoding with Shared Prefixes in LLMs","version":2},"cited_work":{"arxiv_id":"2403.08845","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.08845","snapshot_observed_at":"2026-06-30T21:05:04.535360Z","title":"Bifurcated attention: Accelerating massively parallel decoding with shared prefixes in LLMs","venue":null,"work_id":"7353d30d-3132-48af-8070-2a40878f39a3","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2403.08845","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:8c3195a2ab6ec3c174a133de8f8ddc74853caa2ce54d0f1aac65abcbee5e87c0","observation_id":"4c8c871b-8641-46e0-85a3-6b05dc617ffa","resolution":{"observed_at":"2026-05-12T04:42:23.420509Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bowman, Zac Hatfield-Dodds, Ben Mann, Dario Amodei, Nicholas Joseph, Sam McCandlish, Tom Brown, and Jared Kaplan","venue":null,"work_id":"19bc1946-1565-4328-92ea-a230a57a8bbf","year":2022},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:0a1871a5e0174a8726a339c3fcce15ed4372b1c300808f378c68533f034bbe93","observation_id":"8a696795-29ca-43b9-90df-6f4f604664e2","resolution":{"observed_at":"2026-05-12T04:42:23.746504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v38i16.29720","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T20:47:22.304769Z","title":"Graph of thoughts: Solving elaborate problems with large language models","venue":null,"work_id":"255ad1e4-3af4-4d00-9c60-1a05089076cc","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:27b5c112183eb34250c681ed0ef1018ed136062e5452e5b41bac1b99bc155742","observation_id":"f134d4fa-c9fa-47d6-85ad-9b4e1d10a85a","resolution":{"observed_at":"2026-05-12T04:42:23.375350Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:19:10.190918+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:19:10.190918+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01373","last_updated":"2023-05-31T17:54:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-03T20:58:15Z","title":"Pythia: A Suite for Analyzing Large Language Models Across Training and Scaling","version":2},"cited_work":{"arxiv_id":"2304.01373","doi":"10.48550/arxiv.2304.01373","metadata_source":"pith","pith_arxiv_id":"2304.01373","snapshot_observed_at":"2026-07-11T03:37:46.261104Z","title":"Pythia: A Suite for Analyzing Large Language Models Across Training and Scaling","venue":"cs.CL","work_id":"745b4799-6ac4-4abe-924f-78bf0a08ffa1","year":2023},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2304.01373","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:784e08f58f8b064bd71a812588d672759bc76a2ec079f62253721777ab208b89","observation_id":"da70201d-24aa-4715-8de9-378e10adaadd","resolution":{"observed_at":"2026-05-15T17:45:18.440424Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Combining deep reinforcement learning and search for imperfect-information games","venue":null,"work_id":"79ca22e4-7f06-4f48-8394-decdbddb802a","year":2020},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:7662ca32d4d54b1b61490cd5246bacef35b1069812a2ad88f87218f63d7d15d0","observation_id":"a4c5aef6-61ef-4bff-b197-96d5c293eb73","resolution":{"observed_at":"2026-05-12T04:42:23.751010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":"2005.14165","doi":"10.1145/1926385.1926423","metadata_source":"pith","pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Language Models are Few-Shot Learners","venue":"cs.CL","work_id":"214732c0-2edd-44a0-af9e-28184a2b8279","year":2020},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:d6307bc560828861d1c3c027ff8402a055d5ef58cb690844ed375d338f98a640","observation_id":"582ab912-b458-467e-ad4c-96140659d62d","resolution":{"observed_at":"2026-05-12T04:42:23.444167Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-09T08:48:33.42086+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T08:48:33.42086+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/s0004-3702(01)00129-1","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T13:57:06.891227Z","title":"Joseph Hoane, and Feng-hsiung Hsu","venue":null,"work_id":"ab2334c7-df3d-46a1-8cc6-f54aabe31fae","year":2002},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:f6e9125054ba32c31812613f0d17545e05ea6a4f2dcc4c63fa41ca31dcf943c8","observation_id":"34bb5a55-519a-43c5-96e2-cc5d5b084b7b","resolution":{"observed_at":"2026-05-12T04:42:23.367091Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-20T19:52:12.051644+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T19:52:12.051644+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Alphamath almost zero: process supervision without process","venue":null,"work_id":"a725721e-742f-4e25-bf38-41c8a53b58d5","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:d0a106bc0f818e77ab637f292ff7526e84c95021c5225e87c92c29524edda35d","observation_id":"c4267d61-6e44-4fc7-94a5-1df37d6e5ae4","resolution":{"observed_at":"2026-05-12T04:42:23.755974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02419","last_updated":"2024-06-04T21:20:33Z","snapshot_observed_at":"2026-07-06T17:39:29.151236Z","submitted_at":"2024-03-04T19:12:48Z","title":"Are More LLM Calls All You Need? Towards Scaling Laws of Compound Inference Systems","version":2},"cited_work":{"arxiv_id":"2403.02419","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.02419","snapshot_observed_at":"2026-06-30T09:44:37.101148Z","title":"Are more llm calls all you need? Towards scaling laws of compound inference systems","venue":null,"work_id":"11a6e30d-1d15-49ba-9408-0f1386c2c043","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2403.02419","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:d790de70d17a16d57ce23625d364a042dfbd604222526faf47854bbef8216b7a","observation_id":"7b029715-fff4-48f2-87ca-856b43c04d58","resolution":{"observed_at":"2026-05-12T04:42:23.543515Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":"2107.03374","doi":"10.48550/arxiv.2107.03374","metadata_source":"pith","pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-07-11T03:27:46.202228Z","title":"Evaluating Large Language Models Trained on Code","venue":"cs.LG","work_id":"042493e9-b26f-4b4e-bbde-382072ca9b08","year":2021},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:faf8c71aa986fa0c68218c3b80d6bdbacc5453d9e75b62f610c908d85b24215f","observation_id":"619aa561-5dc1-42cf-a232-beee1f382ec0","resolution":{"observed_at":"2026-05-12T04:42:23.548883Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.01547","last_updated":"2019-11-25T13:02:04Z","snapshot_observed_at":"2026-07-06T08:34:41.399203Z","submitted_at":"2019-11-05T00:31:38Z","title":"On the Measure of Intelligence","version":2},"cited_work":{"arxiv_id":"1911.01547","doi":"10.1007/s11432-024-4231-5","metadata_source":"pith","pith_arxiv_id":"1911.01547","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"On the Measure of Intelligence","venue":"cs.AI","work_id":"d8980a59-aa48-447b-8852-b7aca2b41b2c","year":2019},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/1911.01547","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:5d63eafced1187f76a7255ed4325009eb0524937d4aacf4a4e38297076135b02","observation_id":"b9af9498-2482-48a3-8745-11939eec7125","resolution":{"observed_at":"2026-05-12T13:05:34.620543Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03741","last_updated":"2023-02-17T17:00:34Z","snapshot_observed_at":"2026-08-03T14:31:51.401500Z","submitted_at":"2017-06-12T17:23:59Z","title":"Deep reinforcement learning from human preferences","version":4},"cited_work":{"arxiv_id":"1706.03741","doi":"10.48550/arxiv.1706.03741","metadata_source":"pith","pith_arxiv_id":"1706.03741","snapshot_observed_at":"2026-07-10T18:47:31.421755Z","title":"Deep reinforcement learning from human preferences","venue":"stat.ML","work_id":"95b596b9-4880-42ad-ac79-570a3a8a9dee","year":2017},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/1706.03741","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:5f33e2c700858c9e9ddb98c4db03649732d555faeea1da96d057ff283ed562c2","observation_id":"990b57c7-234f-4dd3-9fa1-83cf929dd8ae","resolution":{"observed_at":"2026-05-16T08:39:30.882444Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T04:45:59.141894Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":"1f7ff91e-3d16-4cba-ad18-3c6ae7ec674b","year":2021},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:eb7bc84716a394df7f4159fe61d9710d909b6ae1327d99f92c704084abe158ea","observation_id":"b7c8b051-b78e-4d45-9ec6-ba2ffe1cbbbc","resolution":{"observed_at":"2026-05-12T04:42:23.760891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16831","last_updated":"2024-07-23T20:40:37Z","snapshot_observed_at":"2026-07-06T18:50:57.722348Z","submitted_at":"2024-07-23T20:40:37Z","title":"Networks of Networks: Complexity Class Principles Applied to Compound AI Systems Design","version":1},"cited_work":{"arxiv_id":"2407.16831","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.16831","snapshot_observed_at":"2026-06-30T14:44:45.108013Z","title":"Networks of networks: Complexity class principles applied to compound ai systems design","venue":null,"work_id":"b423c889-a5fe-42ff-8e2b-7cffe4bfbd02","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2407.16831","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:753da02bcc3918153f8850b16fe3501650a3c930e41adf2238a607022fce9cf7","observation_id":"c5e77a22-8b4c-46c3-a73f-8ee1be81ca7b","resolution":{"observed_at":"2026-05-12T04:42:23.628892Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deepseek-v2: A strong, economical, and efficient mixture-of-experts language model","venue":null,"work_id":"7076d431-a02d-40d8-80b6-430b5caba853","year":null},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:2e0a334a958083e0056baf3bb734c55e8604825ac0849609886bb15f4c782eb3","observation_id":"fb955237-bea3-4771-8cdc-eb959617063a","resolution":{"observed_at":"2026-05-12T04:42:23.765990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":"2405.04434","doi":"10.1145/3593013.3594097","metadata_source":"pith","pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","venue":"cs.CL","work_id":"1e1df141-cac8-47fd-b068-c4c96e51e331","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:0ed1435c36b52b15bb6ee4ecc0c791d9e4babd9f5cd550394c160c72d5f0726a","observation_id":"005f53ae-eaf7-4265-a08f-0735f7ea5834","resolution":{"observed_at":"2026-05-12T04:42:23.429350Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The efficiency misnomer","venue":null,"work_id":"247d5e89-dab1-468e-a98a-ddfb1cfb8743","year":null},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:0a018c2a6fed33af3c43e77c61471858fd2c108ad222941f605331b77fc2783c","observation_id":"3c84654f-d75a-47cd-8aa2-cb568f4b4995","resolution":{"observed_at":"2026-05-12T04:42:23.770477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.12894","last_updated":"2022-03-16T13:27:44Z","snapshot_observed_at":"2026-07-06T12:01:21.516883Z","submitted_at":"2021-10-25T12:48:07Z","title":"The Efficiency Misnomer","version":2},"cited_work":{"arxiv_id":"2110.12894","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2110.12894","snapshot_observed_at":"2026-07-03T00:27:29.518762Z","title":"The efficiency mis- nomer.arXiv preprint arXiv:2110.12894","venue":null,"work_id":"94eee652-79df-427d-93c1-8fcdeabc16c7","year":2021},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2110.12894","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:e480e7ceb43bfac1b8fe8764779d7c89ebf5e45c390e76c9e0801dffe3b46161","observation_id":"40c98204-705a-43f8-b35d-3da9cbc0ab7a","resolution":{"observed_at":"2026-05-12T04:42:23.474874Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"records/1025683","doi":"10.5281/zenodo.10256836.url:https://zenodo.org/records/10256836","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Ariel Gera, Odellia Boni, Yotam Perlitz, Roy Bar-Haim, Lilach Eden, and Asaf Yehudai","venue":null,"work_id":"1a8adc3d-c761-4a48-acc1-c04d569c2d4a","year":2023},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:908ffbd2f039eb494cc5a8d91ea60af4d77824b6e5440103bd72501940e699f7","observation_id":"08bf5002-f9a5-4eed-9e4b-db0f62825fcf","resolution":{"observed_at":"2026-05-12T04:42:23.491752Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Geting 50 https://www.lesswrong.com/posts/Rdwui3wHxCeKb7feK/ getting-50-sota-on-arc-agi-with-gpt-4o","venue":null,"work_id":"2ffe283a-35f2-4ac3-8194-13e483f61d00","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:fd5459d61b72e21f63db82965b94ef5ee3338c60790c6e265c7427147a271071","observation_id":"9a413215-68ef-4e6d-b353-b6e4cc1108be","resolution":{"observed_at":"2026-05-12T04:42:23.775094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00725","last_updated":"2024-07-25T11:37:54Z","snapshot_observed_at":"2026-07-06T17:53:44.044640Z","submitted_at":"2024-03-31T15:55:49Z","title":"The Larger the Better? Improved LLM Code-Generation via Budget Reallocation","version":2},"cited_work":{"arxiv_id":"2404.00725","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.00725","snapshot_observed_at":"2026-07-03T11:38:05.363675Z","title":"The larger the better? improved llm code-generation via budget reallocation","venue":null,"work_id":"b33775dd-4f96-4170-9e38-1c0c5ec70a5b","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2404.00725","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:95c81892cdcbe958030a13fbe56bf74bb79ae29aca2e377b58dc28127265cdc5","observation_id":"89b2fca0-f944-4b4e-86d9-7e9ac1e4e989","resolution":{"observed_at":"2026-05-12T04:42:23.537684Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Measuring coding challenge competence with apps","venue":null,"work_id":"79f56903-1765-4b3e-9439-6b613bd61844","year":2021},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:9ebc7a2822a5b2213b60f766f8a1f24c23e5c9d0be63b735b56908bd15f50d0e","observation_id":"dd01a28a-301b-406c-a835-3454908d0eab","resolution":{"observed_at":"2026-05-12T04:42:23.780136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Measuring mathematical problem solving with the math dataset","venue":null,"work_id":"dbd69265-77f8-4306-ae2d-ef48d1fb67b7","year":2021},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:580588a4c3fab3f0ec13a9f157cc9228fbc1dbdf33f8235e40642388c6b42aff","observation_id":"f82f70ab-9b4d-49dd-9ff7-939374f92038","resolution":{"observed_at":"2026-05-12T04:42:23.784276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mostofa Ali Patwary, Yang Yang, and Yanqi Zhou","venue":null,"work_id":"e4c9a72d-da5e-4235-9668-69b1f4562605","year":null},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:da8a4e765be01ab6a14c83c62b00eeefeb52a4078cc0c7e65a787c53c78ef5dd","observation_id":"3873cbdb-4939-4500-aae7-480e71fe766b","resolution":{"observed_at":"2026-05-12T04:42:23.788962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.00409","last_updated":"2017-12-01T17:13:14Z","snapshot_observed_at":"2026-07-06T06:12:18.811024Z","submitted_at":"2017-12-01T17:13:14Z","title":"Deep Learning Scaling is Predictable, Empirically","version":1},"cited_work":{"arxiv_id":"1712.00409","doi":null,"metadata_source":"pith","pith_arxiv_id":"1712.00409","snapshot_observed_at":"2026-07-04T18:40:03.351817Z","title":"Deep Learning Scaling is Predictable, Empirically","venue":"cs.LG","work_id":"3638ccb4-3a4f-460e-8b6f-867a65922801","year":2017},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/1712.00409","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:ef005f6124b5f9547c6d41ebbd4c8dc541d28b023aef08434a652009718e9349","observation_id":"78da744d-cec9-4b0f-b7c1-f004df70c50c","resolution":{"observed_at":"2026-05-12T04:42:23.557841Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":"2203.15556","doi":"10.1098/rsta.2024.0522","metadata_source":"pith","pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Compute-Optimal Large Language Models","venue":"cs.CL","work_id":"b2faf28d-86b7-429c-bc42-469458efc246","year":2022},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:3856ad0e98907ca5708c3aac12e954824357abc9cc37242be3ccd33330cea574","observation_id":"0c9edd13-1fe8-477a-ba4c-7433b7a29ae9","resolution":{"observed_at":"2026-05-12T04:42:23.571168Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T18:24:01.333543Z","title":"V-star: Training verifiers for self-taught reasoners","venue":null,"work_id":"194cd376-7274-47cf-84a7-cc847cdaf6af","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:6bf326a28f684a56ac1cb79b59a5f033a580901a914bad8c480a238a6ef0ff3a","observation_id":"e6dd5db9-7e0c-4dad-97a9-4de650848cb4","resolution":{"observed_at":"2026-05-12T04:42:23.793110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.06135","last_updated":"2023-03-30T18:28:05Z","snapshot_observed_at":"2026-07-06T15:01:26.190348Z","submitted_at":"2023-03-10T18:53:52Z","title":"Rewarding Chatbots for Real-World Engagement with Millions of Users","version":2},"cited_work":{"arxiv_id":"2303.06135","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.06135","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2303.06135 , year=","venue":null,"work_id":"df0d37a8-7318-47ee-8b4c-9bf244cd33ab","year":2023},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2303.06135","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:3ddde8a4f955be905c39cfe82caf49c01e88ac87d208ff5a17c704f45b290047","observation_id":"fcb9b52d-5477-42a5-a5db-c6ed9ff68ddb","resolution":{"observed_at":"2026-05-12T04:42:23.587540Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02561","last_updated":"2023-06-30T21:39:54Z","snapshot_observed_at":"2026-07-06T15:37:54.747810Z","submitted_at":"2023-06-05T03:32:26Z","title":"LLM-Blender: Ensembling Large Language Models with Pairwise Ranking and Generative Fusion","version":3},"cited_work":{"arxiv_id":"2306.02561","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.02561","snapshot_observed_at":"2026-07-04T19:50:11.019242Z","title":"Llm-blender: Ensembling large language models with pairwise ranking and generative fusion","venue":null,"work_id":"1accd5f4-8546-41b7-a132-6f6dde8df864","year":2023},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2306.02561","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:6b0a45584e6fc95945e9c29e5563fc0a1011eb29d7c4a8af291da6f5831e56c4","observation_id":"906c4d2c-0195-49fb-8b93-d3d0fdb74bd5","resolution":{"observed_at":"2026-05-12T04:42:23.593082Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":"2310.06770","doi":"10.1145/512927.512945","metadata_source":"pith","pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","venue":"cs.CL","work_id":"d0effe15-a689-441a-8e3f-ea35f1c4e4b1","year":2023},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:d34a637e16aa2c0abe9828474e04c78902cdd617bc0abf6626490d207be8e61a","observation_id":"5c791fc3-0823-42ca-8d3b-bd9275cecf11","resolution":{"observed_at":"2026-05-12T04:42:23.600970Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.03113","last_updated":"2021-04-15T10:03:37Z","snapshot_observed_at":"2026-07-06T10:57:14.668681Z","submitted_at":"2021-04-07T13:34:25Z","title":"Scaling Scaling Laws with Board Games","version":2},"cited_work":{"arxiv_id":"2104.03113","doi":"10.48550/arxiv.2104.03113","metadata_source":"arxiv_reference","pith_arxiv_id":"2104.03113","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Scaling scaling laws with board games","venue":null,"work_id":"bfdb90ca-16ff-485b-908a-92afffd3e523","year":2021},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2104.03113","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:c8866c1ad5b4e1b702f3fba8c5ec74e52bb01f6895b30d5a643208e55135a7c1","observation_id":"dc063724-65c3-4aab-a2e4-22e068acc4e7","resolution":{"observed_at":"2026-05-12T04:42:23.606185Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05099","last_updated":"2024-05-13T08:49:44Z","snapshot_observed_at":"2026-07-06T17:26:59.606509Z","submitted_at":"2024-02-07T18:53:01Z","title":"Hydragen: High-Throughput LLM Inference with Shared Prefixes","version":2},"cited_work":{"arxiv_id":"2402.05099","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05099","snapshot_observed_at":"2026-07-04T11:39:46.505898Z","title":"Fu, Christopher Ré, and Azalia Mirhoseini","venue":null,"work_id":"252d1f81-2da6-4fc8-bb70-6859e2743517","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2402.05099","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:311dc6632d857d4a7864ca9b43e4ecc1815ef011dd3baad9d65955c33a098eb0","observation_id":"f7378c09-19ef-4bdd-99d8-7d21e8faacae","resolution":{"observed_at":"2026-05-12T04:42:23.616982Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16265","last_updated":"2024-06-26T14:01:15Z","snapshot_observed_at":"2026-08-01T16:15:24.164308Z","submitted_at":"2024-05-25T15:07:33Z","title":"MindStar: Enhancing Math Reasoning in Pre-trained LLMs at Inference Time","version":4},"cited_work":{"arxiv_id":"2405.16265","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.16265","snapshot_observed_at":"2026-06-30T12:44:39.237007Z","title":"Z., Chen, X., Kazemi, A., and Chen, B","venue":null,"work_id":"986902fd-0778-46f0-b5b7-941860a6fab9","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2405.16265","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:406cbf9853c489400a9db40e4bc200efb59e4a2c8be81c410e19c581d0f760f1","observation_id":"4708dbdc-8bcd-46ee-90a5-8d546fdd66ea","resolution":{"observed_at":"2026-05-12T04:42:23.622981Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T02:14:27.067976Z","title":"Brown, Benjamin Chess, Rewon Child, Scott Gray, Alec Radford, Jeffrey Wu, and Dario Amodei","venue":null,"work_id":"2f1066f7-c807-4bb2-b8ad-9900ba3fd8ae","year":2020},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:e13b52f349717c9bf5b22a3993dbba2b6eea5280de16b5997a39694211cc204a","observation_id":"418720fa-9fb0-403c-8026-c22c0f5a026a","resolution":{"observed_at":"2026-05-12T04:42:23.798207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":"2001.08361","doi":"10.1145/3616855.3635845","metadata_source":"pith","pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Scaling Laws for Neural Language Models","venue":"cs.LG","work_id":"b7dd8749-9c45-4977-ab9b-64478dce1ae8","year":2020},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:f5a5e1c7d85036d92eb0ddf0d6ffe5c4c01ac3594326b970148184e746825e4f","observation_id":"7b23daed-7a9f-4d1d-b18e-e7a63b1848e5","resolution":{"observed_at":"2026-05-12T04:42:23.635204Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04908","last_updated":"2019-06-12T03:13:18Z","snapshot_observed_at":"2026-07-06T07:59:43.450553Z","submitted_at":"2019-06-12T03:13:18Z","title":"SPoC: Search-based Pseudocode to Code","version":1},"cited_work":{"arxiv_id":"1906.04908","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.04908","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SPoC: Search-based Pseudocode to Code","venue":"cs.LG","work_id":"3b565545-4b13-473a-9efe-1b2730a172b1","year":2019},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/1906.04908","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:87c744b11f5c792f8d7c92b079eb7207d3bb1d3f5a8c12964c72d3fd657e6b08","observation_id":"f57cd5a6-0851-4c65-8114-dfe3b94d10b8","resolution":{"observed_at":"2026-05-12T04:42:23.641199Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Smith, and Hannaneh Hajishirzi","venue":null,"work_id":"07e1fb25-70e0-40e0-8fee-46897f37bf86","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:8dc25a8cdd6d0e2c92693a024150b68e38d56a073f980edd50a3ccde21703c15","observation_id":"9e18d30e-ca71-4006-9aee-08aee0e67ace","resolution":{"observed_at":"2026-05-12T04:42:23.801833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.14858","last_updated":"2022-07-01T02:15:12Z","snapshot_observed_at":"2026-07-06T13:26:06.337115Z","submitted_at":"2022-06-29T18:54:49Z","title":"Solving Quantitative Reasoning Problems with Language Models","version":2},"cited_work":{"arxiv_id":"2206.14858","doi":"10.48550/arxiv.2206.14858","metadata_source":"pith","pith_arxiv_id":"2206.14858","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Solving Quantitative Reasoning Problems with Language Models","venue":"cs.CL","work_id":"17214d12-1ca8-4186-806d-53c6715383a0","year":2022},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2206.14858","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:f3dd9e6fc4c8e873666f1306440ed61b0b650595f74bd919fc5089207647aae3","observation_id":"3ee246bc-cae0-441f-ae14-6643ce1e4bee","resolution":{"observed_at":"2026-05-12T22:43:59.458883Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-21T13:53:28.356363+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T13:53:28.356363+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1126/science.abq1158","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T12:53:50.117909Z","title":"Mankowitz, Esme Sutherland Robson, Pushmeet Kohli, Nando De Freitas, Koray Kavukcuoglu, and Oriol Vinyals","venue":null,"work_id":"cc452f34-3d34-41ff-9206-8edad6625ce6","year":2022},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:05f51bb798ed6c7995b8636c5f1b96ba537481f657fd85fb6cf7ec5ebbc0d9b5","observation_id":"a7fd96d8-6b0c-4925-9d60-385f6149c8da","resolution":{"observed_at":"2026-05-12T04:42:23.397341Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:23.512078+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:23.512078+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Let’s verify step by step","venue":null,"work_id":"0c7eae2e-1cf8-4bb0-b33d-07cc64d8406f","year":2023},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:9d50d6738ce954096d42ca99cd85ec769c1080727d80232a5191757828a6cfc5","observation_id":"396392a0-64e1-42a3-bc51-24bf37865744","resolution":{"observed_at":"2026-05-12T04:42:23.812195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17651","last_updated":"2023-05-25T19:13:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-30T18:30:01Z","title":"Self-Refine: Iterative Refinement with Self-Feedback","version":2},"cited_work":{"arxiv_id":"2303.17651","doi":"10.1007/s10664-008-","metadata_source":"pith","pith_arxiv_id":"2303.17651","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Self-Refine: Iterative Refinement with Self-Feedback","venue":"cs.CL","work_id":"59181e7f-e58e-45d3-8146-4477a9f53d5a","year":2023},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2303.17651","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:5a7ddabc70d1b0b4af42cf338ee14889bdb15fed637828f180350414a7720aa5","observation_id":"e5bcdb42-3fa1-489a-a787-e5ced658c044","resolution":{"observed_at":"2026-05-12T04:42:23.662757Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05778","last_updated":"2024-07-08T09:37:27Z","snapshot_observed_at":"2026-07-06T18:42:51.512751Z","submitted_at":"2024-07-08T09:37:27Z","title":"When is the consistent prediction likely to be a correct prediction?","version":1},"cited_work":{"arxiv_id":"2407.05778","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.05778","snapshot_observed_at":"2026-06-30T11:54:38.705083Z","title":"When is the consistent prediction likely to be a correct prediction?","venue":null,"work_id":"8d6a3cee-cdb7-41b3-b153-8fdd898e5b0c","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2407.05778","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:b8940adcbbbe4f3639cc863f1bc69b2028bc3eddc7dee6dc7a430c678bdf9ece","observation_id":"ec3f0d04-9d96-4e9c-9107-db6685cfe820","resolution":{"observed_at":"2026-05-12T04:42:23.669724Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18665","last_updated":"2025-02-23T08:50:33Z","snapshot_observed_at":"2026-07-30T15:06:18.011623Z","submitted_at":"2024-06-26T18:10:22Z","title":"RouteLLM: Learning to Route LLMs with Preference Data","version":4},"cited_work":{"arxiv_id":"2406.18665","doi":"10.48550/arxiv.2406.18665","metadata_source":"pith","pith_arxiv_id":"2406.18665","snapshot_observed_at":"2026-07-10T20:57:34.931879Z","title":"RouteLLM: Learning to Route LLMs with Preference Data","venue":"cs.LG","work_id":"f6b91d8a-ce78-4b5e-9dae-6dd8a22cc087","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2406.18665","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:0af52a427a4546d8b214af1984e8ed6f8cdcb5ff61be775f7f86d36e7c1e6c54","observation_id":"2401578f-0e00-4b1b-a4a8-f8a50b94b024","resolution":{"observed_at":"2026-05-12T04:42:23.676472Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:21.122549+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:21.122549+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:8f4307ed958c8135800aa1f42e9e35825ac3f34923d126743a06b721c683f954","observation_id":"0cfef5dc-e60d-426e-aee2-612ee72c6aec","resolution":{"observed_at":"2026-05-12T04:42:23.684418Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":"d32fd3de-b200-47e1-823f-c47e9019f299","year":2019},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:bac79203521d1fac65c15ff36cc63861424a5c4c517fad1103ee188439c62138","observation_id":"5f4d05e1-8a63-44f4-800e-1d4e2bf0024e","resolution":{"observed_at":"2026-05-12T04:42:23.818408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Code llama: Open foundation models for code","venue":null,"work_id":"fdd2757a-f36f-4cc9-ba2d-f6fb9fc88826","year":2023},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:9ace3c911452e2f3077ad490f670badb6b7405e5febe303b9732629abb96a7e9","observation_id":"4c2eea49-a0c9-4b0b-9e79-1e7156325b7c","resolution":{"observed_at":"2026-05-12T04:42:23.826458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12854","last_updated":"2024-07-09T08:27:27Z","snapshot_observed_at":"2026-07-06T18:48:00.070861Z","submitted_at":"2024-07-09T08:27:27Z","title":"Scaling Retrieval-Based Language Models with a Trillion-Token Datastore","version":1},"cited_work":{"arxiv_id":"2407.12854","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.12854","snapshot_observed_at":"2026-07-11T00:47:43.022629Z","title":"Shao et al","venue":"cs.CL","work_id":"ae4a7a28-e04c-4956-b87b-af0ddad29266","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2407.12854","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:f9d9e26ad1ae7208d8b93d6c7c65bbd4bc4b7dc07a23e6fb91955f9239cce551","observation_id":"46de6551-32f9-4611-8465-4fe5e5c7fd8d","resolution":{"observed_at":"2026-05-12T04:42:23.438171Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mastering chess and shogi by self-play with a general reinforcement learning algorithm","venue":null,"work_id":"8cb92445-15a3-4f93-8478-f78910f2c99b","year":2017},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:3f87591b6634e8043ede9f33c0a1326fc89f8491a0c0eed8da57a2a56819aab7","observation_id":"22427f68-1841-4011-b528-f736c187ac8f","resolution":{"observed_at":"2026-05-12T04:42:23.831559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10457","last_updated":"2024-07-15T06:12:17Z","snapshot_observed_at":"2026-07-06T18:46:18.540571Z","submitted_at":"2024-07-15T06:12:17Z","title":"The Good, The Bad, and The Greedy: Evaluation of LLMs Should Not Ignore Non-Determinism","version":1},"cited_work":{"arxiv_id":"2407.10457","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.10457","snapshot_observed_at":"2026-07-03T17:48:45.447795Z","title":"The good, the bad, and the greedy: Evaluation of llms should not ignore non-determinism","venue":null,"work_id":"7b257233-7d88-48df-8208-6dea20dbedea","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2407.10457","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:2740217927059e33a317d96db5fa5147cf5b8ccc02a31dcde79ecc2d816b6dc5","observation_id":"77c12347-f8b1-4204-aee5-3b194378bfd0","resolution":{"observed_at":"2026-05-12T04:42:23.449917Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":"2403.08295","doi":"10.48550/arxiv.2403.08295","metadata_source":"pith","pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-07-10T23:07:48.332027Z","title":"Gemma: Open Models Based on Gemini Research and Technology","venue":"cs.CL","work_id":"a9ea2870-df28-40b8-a9e0-a7e9a116f793","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:d9e6df36d76aed5c000de69a9372f78d3a4eef828b61cd5c2426024c5fd8b237","observation_id":"7aaba7c9-ef36-45fa-a898-5fffde48efb4","resolution":{"observed_at":"2026-05-12T04:42:23.454784Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12253","last_updated":"2024-12-10T18:19:29Z","snapshot_observed_at":"2026-07-06T18:02:15.186390Z","submitted_at":"2024-04-18T15:21:34Z","title":"Toward Self-Improvement of LLMs via Imagination, Searching, and Criticizing","version":2},"cited_work":{"arxiv_id":"2404.12253","doi":"10.48550/arxiv.2404.12253","metadata_source":"pith","pith_arxiv_id":"2404.12253","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"arXiv preprint arXiv:2404.12253 , year=","venue":"cs.CL","work_id":"bfbcc382-9c9b-4d33-978d-ed13e626dfb7","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2404.12253","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:eb62f0ad48a35dc8fe2ecb5a6f83d3f09dbb19aa35d5fa65d09367435e4c5052","observation_id":"c6411e33-2113-43d8-80a9-6fa6f905d9d9","resolution":{"observed_at":"2026-05-12T04:42:23.462705Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:40.993352+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:40.993352+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41586-023-06747-5","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T19:27:18.435838Z","title":"Trinh, Yuhuai Wu, Quoc V","venue":null,"work_id":"e1a68404-1ded-43fe-aab3-8f5651afeea5","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:5504e9984b7744e963f291a0882877e3d16f8a27b4eb0b2ad771706ec9d0ba04","observation_id":"ea476788-27b4-4f39-a17d-9b3ffb843222","resolution":{"observed_at":"2026-05-12T04:42:23.361347Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[{"edge_observation":{"observed_at":"2026-07-11T04:03:02.578933+00:00","source":"paper_reference_links","state":"open"},"event_date":"2024-02-23","event_type":"correction","notice_doi":"10.1038/s41586-024-07115-7","provenance":{"observed_at":"2026-07-11T03:09:49.232535+00:00","source":"crossref","source_record_id":"10.1038/s41586-024-07115-7->10.1038/s41586-023-06747-5:correction"}}],"reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41592-019-0686-2","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T02:37:45.798234Z","title":"Oliphant, Matt Haberland, Tyler Reddy, David Cournapeau, Evgeni Burovski, Pearu Peterson, Warren Weckesser, Jonathan Bright, St´ efan J","venue":"Nature Methods","work_id":"1a44c2d3-9a48-46f3-924b-d2fa43b6729a","year":2020},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:7dd7385ad8ae30fec03f9fc9c7db5f769ba187b66aeaeedd503f5497560d2cec","observation_id":"8105cc0c-ad39-4461-ab4d-ddfc277f6e07","resolution":{"observed_at":"2026-05-12T04:42:23.354126Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[{"edge_observation":{"observed_at":"2026-07-11T04:03:04.304611+00:00","source":"paper_reference_links","state":"open"},"event_date":"2020-03-04","event_type":"correction","notice_doi":"10.1038/s41592-020-0772-5","provenance":{"observed_at":"2026-07-11T03:08:19.430942+00:00","source":"crossref","source_record_id":"10.1038/s41592-020-0772-5->10.1038/s41592-019-0686-2:correction"}}],"reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10491","last_updated":"2024-01-22T17:16:37Z","snapshot_observed_at":"2026-07-06T17:17:44.177514Z","submitted_at":"2024-01-19T05:02:46Z","title":"Knowledge Fusion of Large Language Models","version":2},"cited_work":{"arxiv_id":"2401.10491","doi":"10.48550/arxiv.2401.10491","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.10491","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Knowledge fusion of large language models","venue":null,"work_id":"839476d4-4595-4604-8da7-24f717a1fa63","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2401.10491","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:348d340235cfff813454af31efffcab05ecb7207239e3b6e9f57676905fd02b2","observation_id":"e2c54041-1b64-4c12-a1db-edcbf0ae80ea","resolution":{"observed_at":"2026-05-12T04:42:23.469399Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Interpretable preferences via multi-objective reward modeling and mixture-of-experts","venue":null,"work_id":"c36d5c03-a27f-4060-9016-07c969d6a0f5","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:8563712793517c312e6819a29a8a5563fc424b96ae79e643bd768ede0e16b8ec","observation_id":"63ebb482-6473-41ce-9756-7a13dd0c6761","resolution":{"observed_at":"2026-05-12T04:42:23.839355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04692","last_updated":"2024-06-07T07:04:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-07T07:04:10Z","title":"Mixture-of-Agents Enhances Large Language Model Capabilities","version":1},"cited_work":{"arxiv_id":"2406.04692","doi":"10.48550/arxiv.2406.04692","metadata_source":"pith","pith_arxiv_id":"2406.04692","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Mixture-of-Agents Enhances Large Language Model Capabilities","venue":"cs.CL","work_id":"3efec870-3e92-4baa-be9f-50e1aa07140f","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2406.04692","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:6eb4a4e967a12d11862252e4c90e4a3427b2154014c65cba6e8b624013365d66","observation_id":"8cc6bb3d-74c1-4984-8a86-23c4236730fb","resolution":{"observed_at":"2026-05-16T19:29:34.516338Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08935","last_updated":"2024-02-19T14:07:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-14T13:41:54Z","title":"Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations","version":3},"cited_work":{"arxiv_id":"2312.08935","doi":"10.48550/arxiv.2312.08935","metadata_source":"pith","pith_arxiv_id":"2312.08935","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations","venue":"cs.AI","work_id":"fb547990-d48e-4ba3-a047-af1e506e8290","year":2023},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2312.08935","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:af2acb169a2a172206e021199980c9d047a541fe2f468fb3cc98407db2e25edb","observation_id":"547f3617-3513-4e83-80f6-0519d104b7b0","resolution":{"observed_at":"2026-05-14T22:34:16.071337Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Self-consistency improves chain of thought reasoning in language models","venue":null,"work_id":"854c612c-6f04-4a37-bd92-585ff4db18c2","year":2023},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:6ea3eb791a6a90d77bc861ecd09b28972f88810d8e447c1f16cfb2615a5859da","observation_id":"fc68a623-0d48-4664-a54f-44b9cc843aa4","resolution":{"observed_at":"2026-05-12T04:42:23.844463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":"3032372e-20c0-40fa-9f11-866e1a2d183e","year":2023},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:a24bb772dd9f84d8b380439bb51a202601195687f6a3c7f7804546c50e7cafab","observation_id":"408a4309-6ebc-4d16-96a1-a62ee6373ff4","resolution":{"observed_at":"2026-05-12T04:42:23.854457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03629","last_updated":"2023-03-10T01:00:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-06T01:00:32Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","version":3},"cited_work":{"arxiv_id":"2210.03629","doi":"10.48550/arxiv.2210.03629","metadata_source":"pith","pith_arxiv_id":"2210.03629","snapshot_observed_at":"2026-07-11T03:47:47.842265Z","title":"ReAct: Synergizing Reasoning and Acting in Language Models","venue":"cs.CL","work_id":"407a2351-25f1-497d-b611-f77d0292a8e6","year":2022},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2210.03629","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:cc0ac096683845ddb636a202871a4445878ac21963ed73f53cf340149f0e3d1b","observation_id":"87ff9e92-0c87-4170-8373-b0949ac41250","resolution":{"observed_at":"2026-05-12T04:42:23.497100Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T03:19:36.897515+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T03:19:36.897515+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10601","last_updated":"2023-12-03T22:50:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T23:16:17Z","title":"Tree of Thoughts: Deliberate Problem Solving with Large Language Models","version":2},"cited_work":{"arxiv_id":"2305.10601","doi":"10.48550/arxiv.2305.10601","metadata_source":"pith","pith_arxiv_id":"2305.10601","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Tree of Thoughts: Deliberate Problem Solving with Large Language Models","venue":"cs.CL","work_id":"07adb06e-4ed5-4ec5-a7ae-ff288fd214fb","year":2023},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2305.10601","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:5e8045283e782f029eb4de55070918b2a1ce5581e821ee6ccf789fe17e7a2182","observation_id":"9f5d7f8f-e551-4568-b5bf-0ca358eb6a81","resolution":{"observed_at":"2026-05-12T04:42:23.503564Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:14.037057+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:14.037057+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09629","last_updated":"2024-03-18T07:56:48Z","snapshot_observed_at":"2026-07-31T09:25:34.205362Z","submitted_at":"2024-03-14T17:58:16Z","title":"Quiet-STaR: Language Models Can Teach Themselves to Think Before Speaking","version":2},"cited_work":{"arxiv_id":"2403.09629","doi":"10.48550/arxiv.2403.09629","metadata_source":"pith","pith_arxiv_id":"2403.09629","snapshot_observed_at":"2026-07-10T11:37:03.291962Z","title":"Quiet-STaR: Language Models Can Teach Themselves to Think Before Speaking","venue":"cs.CL","work_id":"cd82874a-9e9d-46cb-9716-a06d454a9c7e","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2403.09629","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:54161cf284609dbb5bcfe8a1a288bd0a88ec0e4ec45d172d3b6bb55971aa996e","observation_id":"b2c7a2eb-02f6-4831-97d2-5c9bbb2f5cfd","resolution":{"observed_at":"2026-05-16T05:45:05.263509Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.00110","last_updated":"2022-02-28T06:03:23Z","snapshot_observed_at":"2026-08-02T08:23:52.941911Z","submitted_at":"2021-08-31T23:21:12Z","title":"MiniF2F: a cross-system benchmark for formal Olympiad-level mathematics","version":2},"cited_work":{"arxiv_id":"2109.00110","doi":"10.48550/arxiv.2109.00110","metadata_source":"pith","pith_arxiv_id":"2109.00110","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"MiniF2F: a cross-system benchmark for formal Olympiad-level mathematics","venue":"cs.AI","work_id":"a2b8fa24-3524-46cc-b33e-a2f51303d17d","year":2021},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2109.00110","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:17d5a9db13b625ae69df3adef8953288c94e9339b815c00b7a931c8cd08ae133","observation_id":"77d8e953-1827-493a-b3c5-c86f53b0cfd3","resolution":{"observed_at":"2026-05-16T20:03:04.481585Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07104","last_updated":"2024-06-06T00:10:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-12T09:34:27Z","title":"SGLang: Efficient Execution of Structured Language Model Programs","version":2},"cited_work":{"arxiv_id":"2312.07104","doi":"10.48550/arxiv.2312.07104","metadata_source":"pith","pith_arxiv_id":"2312.07104","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"SGLang: Efficient Execution of Structured Language Model Programs","venue":"cs.AI","work_id":"bcc79aed-93ef-4b91-94e6-e62b5fa15ce7","year":2023},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"cited_paper":"/paper/2312.07104","citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:5148d8afe257a305d57243f1612adaf950a40f82a92a315668811d1e5de5a12b","observation_id":"2611a68e-8f2e-4ccf-8031-76d4f7472c8f","resolution":{"observed_at":"2026-05-12T08:20:01.305558Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Moatless tools","venue":null,"work_id":"98ebe7d4-73a2-43be-8534-e7542a6b6b7a","year":2024},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:01c689d9269971b57d30b9cf6d6eba723dfb4d4fe3a0e7fb9c02d1a5b37d73db","observation_id":"a046ff29-7186-4fc4-ab29-08baf5fc3eeb","resolution":{"observed_at":"2026-05-12T04:42:23.859295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b270a824-7997-46dc-869e-5c5308289bf5","year":null},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:545a95ccece3aa624412c06ccb88a74da657a71e8a5095b62c796f8448cbc4e3","observation_id":"d97f8be6-bc12-468c-b3aa-16b8b33a5822","resolution":{"observed_at":"2026-05-12T04:42:23.866228Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In order to avoid leaking information about how to solve the theorem from its name, we replace the name of the theorem with theorem_i","venue":null,"work_id":"83ac5181-0481-43b6-bbe0-39f9d0a584ee","year":null},"citing_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-12T04:42:23.297389Z"},"links":{"citing_paper":"/paper/2407.21787"},"observation_digest":"sha256:6b007f52832b3f2e70f9982938b94760dc07259777ccd37de1d87c7541b32495","observation_id":"e742818e-88de-4de9-b141-87ad08f6e89a","resolution":{"observed_at":"2026-05-12T04:42:23.700716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":0,"metadata_mismatch":13,"parse_uncertain":0,"unresolved":1,"verified_exact":31,"verified_fuzzy":27},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 100 inbound Pith citation observations for arXiv:2407.21787."}