{"as_of":"2026-08-08T07:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1e98e82ef1b95f203b0c45d5c535ad457631655e0ebe38e53b1d0b3a98b2de5c","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:14:23.666202Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.19634/citation-record","integrity":"/paper/2505.19634/integrity","json":"/paper/2505.19634/citation-record.json","paper":"/paper/2505.19634"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:20.849185Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:20.849185Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:35c279b0123f6de7c5ec442f17a6a5b1d8ab4d50658cb752bd566a86df747a6e","observation_id":"aac5cdee-36ec-4931-83cd-e14e19b84e5d","resolution":{"observed_at":"2026-08-07T14:14:20.849185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:20.896928Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:20.896928Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:da08e3c27cc1f52b03e1c39e32aa4dc45846c4d3e2b44ea7cf4c60e2e4a3e155","observation_id":"d307be07-e554-4d3e-8550-97389933be11","resolution":{"observed_at":"2026-08-07T14:14:20.896928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05109","last_updated":"2024-10-07T16:21:29Z","snapshot_observed_at":"2026-08-03T23:07:15.667650Z","submitted_at":"2024-02-07T18:58:50Z","title":"Hydra: Sequentially-Dependent Draft Heads for Medusa Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05109","snapshot_observed_at":"2026-08-07T14:14:20.990978Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:20.990978Z"},"links":{"cited_paper":"/paper/2402.05109","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:d367de7d9cd624dfff5159935d4d03ca28235262e14a29b3e88448869e65f5db","observation_id":"52ffbfa3-4311-478a-b7b2-70cf8f7e6922","resolution":{"observed_at":"2026-08-07T14:14:20.990978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:25.201634Z","title":null,"venue":null,"work_id":"267474f3-ce06-4f52-af09-8c965250d44e","year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:21.050136Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:37d930f24e0018fa4d4f0dff50c9186a4d5817d77d150ab3ed9b08ce3ab5c988","observation_id":"7c906ed0-9dec-40a0-9909-6be861d3490c","resolution":{"observed_at":"2026-08-07T14:14:25.266685Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:25.015654Z","title":null,"venue":null,"work_id":"23b7079c-206b-4d8e-a0dc-0f9c8d7e5fe1","year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:21.137331Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:a5757dae0532c95ab720117af6019b299a23f38c025a92a15dc0e803f49e25d8","observation_id":"2475f915-e570-461e-b468-fe9f582b02c5","resolution":{"observed_at":"2026-08-07T14:14:25.109306Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-07T14:14:21.211170Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:21.211170Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:85d8e5f38df2e899c6ed933c1d78d7412e40ce97d469ccd7fc496523a2c5c935","observation_id":"83b2dbee-93be-4b24-afe5-63de353efd1c","resolution":{"observed_at":"2026-08-07T14:14:21.211170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-07T14:14:21.279768Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:21.279768Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:b0a6f33641af2e8945fdcd92aaeb31f738dcf987b6476e1530cfc919b98a746e","observation_id":"bd6a1831-87fe-45e4-ad82-3e1bedfc5a75","resolution":{"observed_at":"2026-08-07T14:14:21.279768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10774","last_updated":"2024-06-14T23:32:32Z","snapshot_observed_at":"2026-07-06T17:17:56.276857Z","submitted_at":"2024-01-19T15:48:40Z","title":"Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10774","snapshot_observed_at":"2026-08-07T14:14:21.343342Z","title":"Lee, Deming Chen, and Tri Dao","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:21.343342Z"},"links":{"cited_paper":"/paper/2401.10774","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:27315ff9f9407b4e1ff8fbb9f000849dcc3b524444154a9ba5caf5fd0554d934","observation_id":"ad607972-c16e-439e-97a6-6881fe0a61a9","resolution":{"observed_at":"2026-08-07T14:14:21.343342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-07T14:14:21.428644Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:21.428644Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:5f9d0f122d5d44ce7e00101e85459e855a4b5662637871788d6ac95dcf0332e2","observation_id":"84de4233-7493-4613-a096-cdbfbc27b29d","resolution":{"observed_at":"2026-08-07T14:14:21.428644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05609","last_updated":"2025-02-08T15:32:53Z","snapshot_observed_at":"2026-07-06T20:33:20.038920Z","submitted_at":"2025-02-08T15:32:53Z","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05609","snapshot_observed_at":"2026-08-07T14:14:21.520298Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:21.520298Z"},"links":{"cited_paper":"/paper/2502.05609","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:91cbf072064705c38cb596e1a089a9c91a4536e78b9681c8ba1f5ea8cd1b4830","observation_id":"512295ff-e0ef-409b-94d9-2f00cf25795f","resolution":{"observed_at":"2026-08-07T14:14:21.520298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04519","last_updated":"2025-01-08T14:12:57Z","snapshot_observed_at":"2026-08-04T20:57:22.329262Z","submitted_at":"2025-01-08T14:12:57Z","title":"rStar-Math: Small LLMs Can Master Math Reasoning with Self-Evolved Deep Thinking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04519","snapshot_observed_at":"2026-08-07T14:14:21.569416Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:21.569416Z"},"links":{"cited_paper":"/paper/2501.04519","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:d83f0e7e4f5e4db721304450530fe8a4597623a80198148b733ca83566b83bd2","observation_id":"bf166085-f870-4f4d-bd71-c6c1dacb4a81","resolution":{"observed_at":"2026-08-07T14:14:21.569416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T14:14:21.669934Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:21.669934Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:a86550d60fc433089a124bb3b3fcd87d7e38ce6ad0c7be30c2d019b0d51077ff","observation_id":"ba8dbf1b-46b1-445b-9979-ef2715ad2f57","resolution":{"observed_at":"2026-08-07T14:14:21.669934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-07T14:14:21.759921Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:21.759921Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:b1e3d1fa5a082ae9f8b8deadc5aaa1c5ce804161e11746c8aacfbdf1dfc281c5","observation_id":"cbaab37d-1999-4ade-b959-bfd2b75494a2","resolution":{"observed_at":"2026-08-07T14:14:21.759921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:21.835787Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:21.835787Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:365522cdb2f28f48ed1aa157fecddf50d1773f95e92b6cf91b7973099577f888","observation_id":"2a0b5809-9035-4686-85b8-f5284a19deae","resolution":{"observed_at":"2026-08-07T14:14:21.835787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09891","last_updated":"2025-01-17T00:41:44Z","snapshot_observed_at":"2026-08-07T18:09:30.057330Z","submitted_at":"2025-01-17T00:41:44Z","title":"Evolving Deeper LLM Thinking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09891","snapshot_observed_at":"2026-08-07T14:14:21.933314Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:21.933314Z"},"links":{"cited_paper":"/paper/2501.09891","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:df1923c0ea762f796b7e567929e1ba7922763dd1f0253df1dee00d4a2aefa93a","observation_id":"ee65c85e-763f-4d02-8b89-2c59df45ac41","resolution":{"observed_at":"2026-08-07T14:14:21.933314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:22.011774Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.011774Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:503696450a8596853d5e11271ec4053d800e75879ead8b8fe584942a9f33d58f","observation_id":"048e12d2-b409-4c16-833b-57db1ee5873d","resolution":{"observed_at":"2026-08-07T14:14:22.011774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:24.858213Z","title":null,"venue":null,"work_id":"d71a914e-e1f6-40c6-be5b-3207b6349be6","year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.100607Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:55cee9a04649b58eab1fe4cc758d7e5c0c4239c20b1473139ab679268a49d3db","observation_id":"62d29a2d-c800-443a-a3d0-89b701e61319","resolution":{"observed_at":"2026-08-07T14:14:24.941453Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:24.668769Z","title":null,"venue":null,"work_id":"39b912c9-0947-4e75-b772-1430f35d7e1c","year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.192586Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:d0a3548f2b08bcc05f8762d569d988917b1237f53774771c77a0ac55f0569599","observation_id":"2edbe66b-5b88-4e7d-ae3b-2b30a219c889","resolution":{"observed_at":"2026-08-07T14:14:24.773911Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01840","last_updated":"2025-04-23T07:08:17Z","snapshot_observed_at":"2026-07-06T20:45:55.263034Z","submitted_at":"2025-03-03T18:59:04Z","title":"EAGLE-3: Scaling up Inference Acceleration of Large Language Models via Training-Time Test","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01840","snapshot_observed_at":"2026-08-07T14:14:22.274278Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.274278Z"},"links":{"cited_paper":"/paper/2503.01840","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:a40ab42beb440b7bbbad4aafa2c96c548b710a16280ccfe14b5fb56daed943ae","observation_id":"006f8452-bf4b-4da0-a950-496d4078bd4a","resolution":{"observed_at":"2026-08-07T14:14:22.274278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06703","last_updated":"2025-02-10T17:30:23Z","snapshot_observed_at":"2026-08-05T04:32:32.994993Z","submitted_at":"2025-02-10T17:30:23Z","title":"Can 1B LLM Surpass 405B LLM? Rethinking Compute-Optimal Test-Time Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06703","snapshot_observed_at":"2026-08-07T14:14:22.357992Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.357992Z"},"links":{"cited_paper":"/paper/2502.06703","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:feb42f9f862e05633b657ada2dd05b747200fcb7774220aff61a26f860b0f9bf","observation_id":"770b0951-6d1e-4e04-80c8-1b81e777a340","resolution":{"observed_at":"2026-08-07T14:14:22.357992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:24.516164Z","title":null,"venue":null,"work_id":"74e094b5-fe36-409f-82bf-2e4bbca57e0e","year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.452686Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:434525d27efb0104b11766e3c9b7db5691c83c0c1fffcc94b0306daba3fd0e5c","observation_id":"d68c18c2-584f-499b-8e3d-c4226350db39","resolution":{"observed_at":"2026-08-07T14:14:24.594446Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-07T14:14:22.505414Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.505414Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:5cfccd9d24b4f62406587ab4644ccf05d1baa504746984d4be3ee5654e8b8ea8","observation_id":"d5be18d2-cd9d-4710-909e-f63f96d2644c","resolution":{"observed_at":"2026-08-07T14:14:22.505414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00114","last_updated":"2021-11-30T21:32:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-11-30T21:32:46Z","title":"Show Your Work: Scratchpads for Intermediate Computation with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00114","snapshot_observed_at":"2026-08-07T14:14:22.568702Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.568702Z"},"links":{"cited_paper":"/paper/2112.00114","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:1291f0d518987eefb6f65f11310a6bb6a2b0a5b12d31501c1c40bf89eb074ad0","observation_id":"60d564a2-4815-4eae-a3a3-ec135f2e259e","resolution":{"observed_at":"2026-08-07T14:14:22.568702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:24.376837Z","title":"September 2024","venue":null,"work_id":"6f3eb3d8-d228-4ea6-9e1d-2101f3fc1228","year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.634383Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:9c1733afed5a66aac7cde496e4a14b3f21562e1f35dbf7fff156abffcc797250","observation_id":"d5914a40-4819-44ac-87c7-e1d7cf7beea7","resolution":{"observed_at":"2026-08-07T14:14:24.445470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:22.697519Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.697519Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:6a459c615234985866019ab01cef3a50e9fdeac9426129a920cc28aae9aea71c","observation_id":"42edd81e-fbf0-4256-8f71-d1834e4d9b6d","resolution":{"observed_at":"2026-08-07T14:14:22.697519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12118","last_updated":"2025-02-18T18:54:12Z","snapshot_observed_at":"2026-08-07T18:11:25.040275Z","submitted_at":"2025-02-17T18:43:24Z","title":"Scaling Test-Time Compute Without Verification or RL is Suboptimal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12118","snapshot_observed_at":"2026-08-07T14:14:22.796446Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.796446Z"},"links":{"cited_paper":"/paper/2502.12118","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:8c098e06ef2031e4b1d39b33a8f7e2c0fc8dc3b662bb5a8191faa81f93d46322","observation_id":"00262278-648d-401e-83b7-43a01aac0f27","resolution":{"observed_at":"2026-08-07T14:14:22.796446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10337","last_updated":"2025-04-16T14:58:26Z","snapshot_observed_at":"2026-08-07T16:05:50.114818Z","submitted_at":"2025-04-14T15:46:33Z","title":"Heimdall: test-time scaling on the generative verification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10337","snapshot_observed_at":"2026-08-07T14:14:22.894186Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.894186Z"},"links":{"cited_paper":"/paper/2504.10337","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:4fe05e397faebc885220b01060a4c7bb674314a76b24645a0fd028a5470c52bf","observation_id":"89eb6f73-dcde-42a1-b3fd-c96b978da84e","resolution":{"observed_at":"2026-08-07T14:14:22.894186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:22.985586Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:22.985586Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:fdedbf417d216eb8fda243d78c45c750ad997938fe4bd7f121c4e78fdbd6382b","observation_id":"0d4cf23e-6a88-436b-a0f7-ed0547f2a68d","resolution":{"observed_at":"2026-08-07T14:14:22.985586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-07T14:14:23.077538Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:23.077538Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:380707d679eb914d2b21d334b2564b59632f50f99cf257a226062a431d59c00c","observation_id":"a7deb134-8cef-40b6-b5d0-244695c3b39d","resolution":{"observed_at":"2026-08-07T14:14:23.077538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:23.158186Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:23.158186Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:0ed2d71c7640ff6a1eaf2167a60314ad2300d2db18bad01d3151a9818bdbdb26","observation_id":"41ea4e1f-7967-4149-b3e2-257ab2c6bb58","resolution":{"observed_at":"2026-08-07T14:14:23.158186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09671","last_updated":"2024-10-12T23:42:16Z","snapshot_observed_at":"2026-08-04T14:33:36.204296Z","submitted_at":"2024-10-12T23:42:16Z","title":"OpenR: An Open Source Framework for Advanced Reasoning with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09671","snapshot_observed_at":"2026-08-07T14:14:23.295558Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:23.295558Z"},"links":{"cited_paper":"/paper/2410.09671","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:1bc72a1c34cbeabefa0529cf87d2398c681562f5f001f4f24d7e2d90708bc337","observation_id":"67fdfbae-6c6f-4133-ab19-e02a88109ce1","resolution":{"observed_at":"2026-08-07T14:14:23.295558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04692","last_updated":"2024-06-07T07:04:10Z","snapshot_observed_at":"2026-08-07T21:51:22.136369Z","submitted_at":"2024-06-07T07:04:10Z","title":"Mixture-of-Agents Enhances Large Language Model Capabilities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04692","snapshot_observed_at":"2026-08-07T14:14:23.344701Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:23.344701Z"},"links":{"cited_paper":"/paper/2406.04692","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:cc175da9ea6783dc361c9f83546c7d96ee9c1244cdd11db8aa8b01a6d4779a10","observation_id":"4a55ccb2-7b8f-43a4-b605-a5962d289216","resolution":{"observed_at":"2026-08-07T14:14:23.344701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-07T14:14:23.391333Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:23.391333Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:b86367af6434e0fa8016afa9f3bae919e8d4527f9e6058a3b8c92abd57a21c9c","observation_id":"4b206e90-f942-4f54-b449-7a5212cfd523","resolution":{"observed_at":"2026-08-07T14:14:23.391333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T14:14:23.470946Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:23.470946Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:84c5bec9583c0169eea22fe1d513e6e54fabb0e125cab8ea70e3c674b14dbbfb","observation_id":"d5f2f4f7-22bc-4f41-bb88-a4411fed815d","resolution":{"observed_at":"2026-08-07T14:14:23.470946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:23.566465Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:23.566465Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:1e537727526b4b6dcc4bfcde4a164f74515d64695b132429dc350fb4686a5c75","observation_id":"c46c84db-aff2-47da-9adb-06ab2e074e8b","resolution":{"observed_at":"2026-08-07T14:14:23.566465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:14:24.178215Z","title":null,"venue":null,"work_id":"af89b0bb-b028-4e13-9ac8-e4339b302e8a","year":2025},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:23.610993Z"},"links":{"citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:4781afea701db3ef1bb4654174cab5d87396c1d4f0c5766cb323cff5667bb5ca","observation_id":"edf41162-daa5-4d41-bcd7-c1eeda2c85af","resolution":{"observed_at":"2026-08-07T14:14:24.243516Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15240","last_updated":"2025-02-22T10:21:46Z","snapshot_observed_at":"2026-07-06T19:06:41.697671Z","submitted_at":"2024-08-27T17:57:45Z","title":"Generative Verifiers: Reward Modeling as Next-Token Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15240","snapshot_observed_at":"2026-08-07T14:14:23.666202Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling","version":4},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T14:14:23.666202Z"},"links":{"cited_paper":"/paper/2408.15240","citing_paper":"/paper/2505.19634"},"observation_digest":"sha256:0d92c976270318da69207df3ae48c4759717285e059e4f12c9c9677fc96794d4","observation_id":"b28ec7bd-1095-44a0-8644-3dc96c72738c","resolution":{"observed_at":"2026-08-07T14:14:23.666202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.19634","last_updated":"2025-09-12T01:41:20Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T14:07:32.863361Z","submitted_at":"2025-05-26T07:51:30Z","title":"Faster and Better LLMs via Latency-Aware Test-Time Scaling"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2505.19634."}