{"as_of":"2026-08-06T13:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cba60cf3e33960dd6f748fb36c147e4462373649af52a0e9df7ad3c23344ce29","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:52:07.851495Z","state":"measured"},{"denominator":71,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":71,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T13:54:17.008295Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"cited_work":{"arxiv_id":"2509.04475","doi":"10.48550/arxiv.2509.04475","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.04475","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Para- thinker: Native parallel thinking as a new paradigm to scale llm test-time compute.arXiv preprint arXiv:2509.04475","venue":"ArXiv.org","work_id":"e496a432-ac79-4fcc-a1b8-69757a7ca2aa","year":2025},"citing_paper":{"arxiv_id":"2510.07286","last_updated":"2026-04-11T09:47:15Z","snapshot_observed_at":"2026-08-04T08:50:20.789394Z","submitted_at":"2025-10-08T17:46:02Z","title":"Evolutionary Profiles for Protein Fitness Prediction","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-18T08:56:44.544404Z"},"links":{"cited_paper":"/paper/2509.04475","citing_paper":"/paper/2510.07286"},"observation_digest":"sha256:f88223b79e6c0506ec0aadbc67ac27f1f84203be863c1fc1d6426b3f93c6fad4","observation_id":"e8a351ff-d8bf-4700-b04a-c38a8979cdc8","resolution":{"observed_at":"2026-05-18T09:01:09.658411Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"cited_work":{"arxiv_id":"2509.04475","doi":"10.48550/arxiv.2509.04475","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.04475","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Para- thinker: Native parallel thinking as a new paradigm to scale llm test-time compute.arXiv preprint arXiv:2509.04475","venue":"ArXiv.org","work_id":"e496a432-ac79-4fcc-a1b8-69757a7ca2aa","year":2025},"citing_paper":{"arxiv_id":"2602.13310","last_updated":"2026-05-07T08:00:36Z","snapshot_observed_at":"2026-08-03T02:11:51.693223Z","submitted_at":"2026-02-10T03:53:25Z","title":"Visual Para-Thinker: Divide-and-Conquer Reasoning for Visual Comprehension","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T03:27:53.694506Z"},"links":{"cited_paper":"/paper/2509.04475","citing_paper":"/paper/2602.13310"},"observation_digest":"sha256:1937ee8a49c03d7874f51190a439e98c01a4d7ddb6c78b7071aac4020780ad74","observation_id":"3b41fb9d-74d5-4a99-a86e-d6017d664a35","resolution":{"observed_at":"2026-05-16T03:30:33.019539Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"cited_work":{"arxiv_id":"2509.04475","doi":"10.48550/arxiv.2509.04475","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.04475","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Para- thinker: Native parallel thinking as a new paradigm to scale llm test-time compute.arXiv preprint arXiv:2509.04475","venue":"ArXiv.org","work_id":"e496a432-ac79-4fcc-a1b8-69757a7ca2aa","year":2025},"citing_paper":{"arxiv_id":"2604.05868","last_updated":"2026-04-07T13:28:09Z","snapshot_observed_at":"2026-08-02T07:08:59.060388Z","submitted_at":"2026-04-07T13:28:09Z","title":"Understanding Performance Gap Between Parallel and Sequential Sampling in Large Reasoning Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T18:36:01.200412Z"},"links":{"cited_paper":"/paper/2509.04475","citing_paper":"/paper/2604.05868"},"observation_digest":"sha256:edf9cb0692a3e923f8962a588da93ff8c2c717e3e054a7e467c25b5686630025","observation_id":"be4e4acb-3b2d-4b11-bed2-6c83d8a1e152","resolution":{"observed_at":"2026-05-11T00:20:52.388721Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"cited_work":{"arxiv_id":"2509.04475","doi":"10.48550/arxiv.2509.04475","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.04475","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Para- thinker: Native parallel thinking as a new paradigm to scale llm test-time compute.arXiv preprint arXiv:2509.04475","venue":"ArXiv.org","work_id":"e496a432-ac79-4fcc-a1b8-69757a7ca2aa","year":2025},"citing_paper":{"arxiv_id":"2604.15529","last_updated":"2026-05-11T04:41:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-16T21:19:35Z","title":"LACE: Lattice Attention for Cross-thread Exploration","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-10T10:24:16.283375Z"},"links":{"cited_paper":"/paper/2509.04475","citing_paper":"/paper/2604.15529"},"observation_digest":"sha256:05597cedc74a737fee81a154c0adb310eb35aaeb07a77d518dce91d7ab350e46","observation_id":"bd8c990f-0a64-4210-98ce-aaee0c2c36f1","resolution":{"observed_at":"2026-05-10T10:24:21.263673Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"cited_work":{"arxiv_id":"2509.04475","doi":"10.48550/arxiv.2509.04475","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.04475","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Para- thinker: Native parallel thinking as a new paradigm to scale llm test-time compute.arXiv preprint arXiv:2509.04475","venue":"ArXiv.org","work_id":"e496a432-ac79-4fcc-a1b8-69757a7ca2aa","year":2025},"citing_paper":{"arxiv_id":"2604.15529","last_updated":"2026-05-11T04:41:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-16T21:19:35Z","title":"LACE: Lattice Attention for Cross-thread Exploration","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-11T00:47:51.440441Z"},"links":{"cited_paper":"/paper/2509.04475","citing_paper":"/paper/2604.15529"},"observation_digest":"sha256:df4a65d6fb270dd3e01c1aa64d1d444a55830c951bc6f81fc642c00a72f6d981","observation_id":"6eb479fe-29c0-44b0-9af5-3b8432a3d71f","resolution":{"observed_at":"2026-05-11T00:50:50.112169Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"cited_work":{"arxiv_id":"2509.04475","doi":"10.48550/arxiv.2509.04475","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.04475","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Para- thinker: Native parallel thinking as a new paradigm to scale llm test-time compute.arXiv preprint arXiv:2509.04475","venue":"ArXiv.org","work_id":"e496a432-ac79-4fcc-a1b8-69757a7ca2aa","year":2025},"citing_paper":{"arxiv_id":"2604.15529","last_updated":"2026-05-11T04:41:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-16T21:19:35Z","title":"LACE: Lattice Attention for Cross-thread Exploration","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-12T04:05:35.063305Z"},"links":{"cited_paper":"/paper/2509.04475","citing_paper":"/paper/2604.15529"},"observation_digest":"sha256:844980ab67464cded35760648d432ed005e990d3e2cced86a606156b8091ca75","observation_id":"c99aec88-f440-490e-a559-d79a2e669c51","resolution":{"observed_at":"2026-05-12T06:36:28.662195Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"cited_work":{"arxiv_id":"2509.04475","doi":"10.48550/arxiv.2509.04475","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.04475","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Para- thinker: Native parallel thinking as a new paradigm to scale llm test-time compute.arXiv preprint arXiv:2509.04475","venue":"ArXiv.org","work_id":"e496a432-ac79-4fcc-a1b8-69757a7ca2aa","year":2025},"citing_paper":{"arxiv_id":"2605.08083","last_updated":"2026-05-12T03:46:05Z","snapshot_observed_at":"2026-07-06T23:20:19.821342Z","submitted_at":"2026-05-08T17:59:40Z","title":"LLMs Improving LLMs: Agentic Discovery for Test-Time Scaling","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-11T01:54:34.000216Z"},"links":{"cited_paper":"/paper/2509.04475","citing_paper":"/paper/2605.08083"},"observation_digest":"sha256:6a257b9518cb8227cd6a270694b043ca8cbb482c55bd24037b022625e101cfff","observation_id":"51389030-720a-45d3-9aa5-fc222de5f328","resolution":{"observed_at":"2026-05-11T04:10:58.079813Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"cited_work":{"arxiv_id":"2509.04475","doi":"10.48550/arxiv.2509.04475","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.04475","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Para- thinker: Native parallel thinking as a new paradigm to scale llm test-time compute.arXiv preprint arXiv:2509.04475","venue":"ArXiv.org","work_id":"e496a432-ac79-4fcc-a1b8-69757a7ca2aa","year":2025},"citing_paper":{"arxiv_id":"2605.08083","last_updated":"2026-05-12T03:46:05Z","snapshot_observed_at":"2026-07-06T23:20:19.821342Z","submitted_at":"2026-05-08T17:59:40Z","title":"LLMs Improving LLMs: Agentic Discovery for Test-Time Scaling","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T07:09:02.672233Z"},"links":{"cited_paper":"/paper/2509.04475","citing_paper":"/paper/2605.08083"},"observation_digest":"sha256:f2564864a30e8b2fc7081d0815de318f89b9d064cf739961222223906e8df057","observation_id":"0ec432f5-2cf0-4185-9a38-f0157bf3ecb1","resolution":{"observed_at":"2026-05-13T07:12:28.263881Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"cited_work":{"arxiv_id":"2509.04475","doi":"10.48550/arxiv.2509.04475","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.04475","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Para- thinker: Native parallel thinking as a new paradigm to scale llm test-time compute.arXiv preprint arXiv:2509.04475","venue":"ArXiv.org","work_id":"e496a432-ac79-4fcc-a1b8-69757a7ca2aa","year":2025},"citing_paper":{"arxiv_id":"2605.15177","last_updated":"2026-05-17T19:31:24Z","snapshot_observed_at":"2026-07-06T23:26:32.979566Z","submitted_at":"2026-05-14T17:57:40Z","title":"OpenDeepThink: Parallel Reasoning via Bradley-Terry Aggregation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T03:06:54.507594Z"},"links":{"cited_paper":"/paper/2509.04475","citing_paper":"/paper/2605.15177"},"observation_digest":"sha256:6ef1f7fd52216e8b376c32918bd889f42432462770e25686917019df1fb91d11","observation_id":"2a8f1a17-f321-401a-81ea-219b47b2dff3","resolution":{"observed_at":"2026-05-15T03:08:58.392741Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"cited_work":{"arxiv_id":"2509.04475","doi":"10.48550/arxiv.2509.04475","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.04475","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Para- thinker: Native parallel thinking as a new paradigm to scale llm test-time compute.arXiv preprint arXiv:2509.04475","venue":"ArXiv.org","work_id":"e496a432-ac79-4fcc-a1b8-69757a7ca2aa","year":2025},"citing_paper":{"arxiv_id":"2605.15177","last_updated":"2026-05-17T19:31:24Z","snapshot_observed_at":"2026-07-06T23:26:32.979566Z","submitted_at":"2026-05-14T17:57:40Z","title":"OpenDeepThink: Parallel Reasoning via Bradley-Terry Aggregation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-20T20:51:47.393589Z"},"links":{"cited_paper":"/paper/2509.04475","citing_paper":"/paper/2605.15177"},"observation_digest":"sha256:3f37f8f4eb19538177dc96a5cd5068eba1f9b95484f354399adb17c94add3d8d","observation_id":"e198c770-da54-4ca7-8dec-9be21bf5f4e8","resolution":{"observed_at":"2026-05-20T20:53:43.617980Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"cited_work":{"arxiv_id":"2509.04475","doi":"10.48550/arxiv.2509.04475","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.04475","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Para- thinker: Native parallel thinking as a new paradigm to scale llm test-time compute.arXiv preprint arXiv:2509.04475","venue":"ArXiv.org","work_id":"e496a432-ac79-4fcc-a1b8-69757a7ca2aa","year":2025},"citing_paper":{"arxiv_id":"2605.27570","last_updated":"2026-05-26T18:43:15Z","snapshot_observed_at":"2026-07-06T23:37:16.981482Z","submitted_at":"2026-05-26T18:43:15Z","title":"LaneRoPE: Positional Encoding for Collaborative Parallel Reasoning and Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-29T17:20:32.711680Z"},"links":{"cited_paper":"/paper/2509.04475","citing_paper":"/paper/2605.27570"},"observation_digest":"sha256:88bae2fbaa0e880812243a1ba16190cfa9ac93cb5c42c6e8f01ad80bb95df15c","observation_id":"e2141cea-d0a1-45b5-be59-c38fe5d489ed","resolution":{"observed_at":"2026-06-29T17:23:44.387402Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"cited_work":{"arxiv_id":"2509.04475","doi":"10.48550/arxiv.2509.04475","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.04475","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Para- thinker: Native parallel thinking as a new paradigm to scale llm test-time compute.arXiv preprint arXiv:2509.04475","venue":"ArXiv.org","work_id":"e496a432-ac79-4fcc-a1b8-69757a7ca2aa","year":2025},"citing_paper":{"arxiv_id":"2606.03102","last_updated":"2026-06-02T03:42:04Z","snapshot_observed_at":"2026-08-03T04:21:57.609394Z","submitted_at":"2026-06-02T03:42:04Z","title":"Small RL Controller, Large Language Model: RL-Guided Adaptive Sampling for Test-Time Scaling","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-06-28T10:25:10.559953Z"},"links":{"cited_paper":"/paper/2509.04475","citing_paper":"/paper/2606.03102"},"observation_digest":"sha256:3543a48a1bc0426881a85b2d5bcbe00fe82cee98d8301f2a951460374313bfb1","observation_id":"0aefda60-2407-456a-af6d-fc5f45df3416","resolution":{"observed_at":"2026-07-02T02:56:29.821933Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.04475","snapshot_observed_at":"2026-08-01T13:54:17.008295Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18979","last_updated":"2026-07-21T11:14:33Z","snapshot_observed_at":"2026-08-06T13:13:54.204332Z","submitted_at":"2026-07-21T11:14:33Z","title":"Fishing Out Free Riders: Shapley-Based Reward Attribution for Parallel Reasoning via Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-01T13:54:17.008295Z"},"links":{"cited_paper":"/paper/2509.04475","citing_paper":"/paper/2607.18979"},"observation_digest":"sha256:57010f546db885fe77ffe3c7fe04fc7f71de595e7222e2e256393a9379e24ca4","observation_id":"a55bf234-7dbe-462a-847e-0e1530b3fae2","resolution":{"observed_at":"2026-08-01T13:54:17.008295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.04475/citation-record","integrity":"/paper/2509.04475/integrity","json":"/paper/2509.04475/citation-record.json","paper":"/paper/2509.04475"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:52:03.326862Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:03.326862Z"},"links":{"citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:03bb9757a939da8b65282074cdc1a73cf319943dd3a752b1d109bdcd14ced6c5","observation_id":"c07cef73-8652-467e-a54e-69f34d662eaa","resolution":{"observed_at":"2026-08-05T13:52:03.326862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:52:03.377348Z","title":"Block diffusion: Interpolating between autoregressive and diffusion language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:03.377348Z"},"links":{"citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:a91c05e2f8c9699a422bd4e824683704d2e3bacb60446b509e9744694c9afd4c","observation_id":"e7ba8d2a-7aeb-4913-944e-38ba2b373775","resolution":{"observed_at":"2026-08-05T13:52:03.377348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-05T13:52:03.442281Z","title":"Accelerating large language model decoding with speculative sampling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:03.442281Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:b9fb59bff1dd85122f403d21bf5f6fe052e6c51b9c276a01fc65a1829b8fdbde","observation_id":"71f089d3-43ec-4d54-809b-6cdc057ccebb","resolution":{"observed_at":"2026-08-05T13:52:03.442281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:52:09.496872Z","title":"Are more llm calls all you need? towards the scaling properties of compound ai systems","venue":null,"work_id":"b3d827f6-e297-4d7d-a6f8-8a7b8323f75c","year":2024},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:03.534465Z"},"links":{"citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:0f87855f56440c5c9b026714553ac9197de0534be7e72a10eaa7993bd95b7343","observation_id":"cb695a11-ea30-4960-a922-78a07b2d6192","resolution":{"observed_at":"2026-08-05T13:52:09.542028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10475","last_updated":"2025-05-15T16:24:45Z","snapshot_observed_at":"2026-07-06T21:24:30.201020Z","submitted_at":"2025-05-15T16:24:45Z","title":"Parallel Scaling Law for Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10475","snapshot_observed_at":"2026-08-05T13:52:03.639253Z","title":"Parallel scaling law for language models, 2025 a","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:03.639253Z"},"links":{"cited_paper":"/paper/2505.10475","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:08ff4ae664f0ae42e55e0b765983a004849d1eb734bab381983ab1232b645725","observation_id":"a8464fe0-7b75-4f41-a026-6aa7729b5837","resolution":{"observed_at":"2026-08-05T13:52:03.639253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-05T13:52:03.703344Z","title":"Do not think that much for 2+3=? on the overthinking of o1-like llms, 2025 b","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:03.703344Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:1eba4649e5a4910ff7882f0adc6e4d704494b5ef6f3adf6fdd3f001835c0507f","observation_id":"d1937aa9-1de8-47c0-b7f9-1583b02da7fe","resolution":{"observed_at":"2026-08-05T13:52:03.703344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:52:09.379838Z","title":"Premise order matters in reasoning with large language models","venue":null,"work_id":"e30fdeed-cb7a-4374-813c-0fe8e87ee6f3","year":2024},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:03.818265Z"},"links":{"citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:8132d4ffdafafb0cde94be85f25b3466f74de2266a4eea19eee033c419ec77e8","observation_id":"51d677a1-92e0-4a73-9c73-839c20f32cf2","resolution":{"observed_at":"2026-08-05T13:52:09.432957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08235","last_updated":"2025-02-12T09:23:26Z","snapshot_observed_at":"2026-07-06T20:35:16.369243Z","submitted_at":"2025-02-12T09:23:26Z","title":"The Danger of Overthinking: Examining the Reasoning-Action Dilemma in Agentic Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08235","snapshot_observed_at":"2026-08-05T13:52:03.922005Z","title":"Gonzalez","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:03.922005Z"},"links":{"cited_paper":"/paper/2502.08235","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:f73a29615f7885631715ab1ad214f35c597d47dc91b54803ede5abf7d625a735","observation_id":"e7aa4903-f407-4b2d-9868-8ebe4318f2a2","resolution":{"observed_at":"2026-08-05T13:52:03.922005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T13:52:03.984821Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:03.984821Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:4b0e64813b324793cdf75edbc856643c19d890ef64f73fed7e3cc7980f70dfbb","observation_id":"869c39e0-bffa-4281-91e3-3e23484389be","resolution":{"observed_at":"2026-08-05T13:52:03.984821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.06514","last_updated":"2025-04-11T02:36:28Z","snapshot_observed_at":"2026-07-06T21:06:27.043207Z","submitted_at":"2025-04-09T01:25:27Z","title":"Missing Premise exacerbates Overthinking: Are Reasoning Models losing Critical Thinking Skill?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.06514","snapshot_observed_at":"2026-08-05T13:52:04.044407Z","title":"Missing premise exacerbates overthinking: Are reasoning models losing critical thinking skill?, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:04.044407Z"},"links":{"cited_paper":"/paper/2504.06514","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:52766d49fb7eaa3d7d6ebb1b7dd84b3d1bc4134cf3568fe231aa535948f5d0ab","observation_id":"dab03832-e741-45b1-9dde-634b53f91162","resolution":{"observed_at":"2026-08-05T13:52:04.044407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09622","last_updated":"2025-06-09T02:36:10Z","snapshot_observed_at":"2026-07-06T20:36:12.548343Z","submitted_at":"2025-02-13T18:59:47Z","title":"Theoretical Benefit and Limitation of Diffusion Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09622","snapshot_observed_at":"2026-08-05T13:52:04.105363Z","title":"Theoretical benefit and limitation of diffusion language model, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:04.105363Z"},"links":{"cited_paper":"/paper/2502.09622","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:16d84b6fff080aefbfa970576c1531df23e12db344643801cc1c608d550cbc03","observation_id":"532ae6df-95f8-46fe-828b-d3186996a125","resolution":{"observed_at":"2026-08-05T13:52:04.105363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05171","last_updated":"2025-02-17T17:14:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-07T18:55:02Z","title":"Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05171","snapshot_observed_at":"2026-08-05T13:52:04.170634Z","title":"Bartoldson, Bhavya Kailkhura, Abhinav Bhatele, and Tom Goldstein","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:04.170634Z"},"links":{"cited_paper":"/paper/2502.05171","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:d12411a78708dfa2ffc9c1b19971a1b3eee7158e350d544c824106d348ade9d6","observation_id":"3c98c3e7-4ca5-4d0f-b22e-f810acc563b9","resolution":{"observed_at":"2026-08-05T13:52:04.170634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:52:04.242257Z","title":"Does thinking more always help? understanding test-time scaling in reasoning models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:04.242257Z"},"links":{"citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:9578053ee7e69b2d2207b2320aef1f46f8731e8fa6d63c502675d8aade4521a0","observation_id":"7c52f26e-16d1-402c-ba69-5c584f72716e","resolution":{"observed_at":"2026-08-05T13:52:04.242257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:52:09.261594Z","title":"Gemini 2.5: Our most intelligent ai model","venue":null,"work_id":"463fa683-c341-4ee7-817b-55f172aefa72","year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:04.331703Z"},"links":{"citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:c72a41ee68019b134244cea18c3f9fa63e2b991480f082b571409ecacb110167","observation_id":"f328a932-66e9-4eda-80f0-9cda928262cb","resolution":{"observed_at":"2026-08-05T13:52:09.315178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04519","last_updated":"2025-01-08T14:12:57Z","snapshot_observed_at":"2026-08-04T20:57:22.329262Z","submitted_at":"2025-01-08T14:12:57Z","title":"rStar-Math: Small LLMs Can Master Math Reasoning with Self-Evolved Deep Thinking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04519","snapshot_observed_at":"2026-08-05T13:52:04.430116Z","title":"rstar-math: Small llms can master math reasoning with self-evolved deep thinking, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:04.430116Z"},"links":{"cited_paper":"/paper/2501.04519","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:8b6ae6fcb87055725e75d0812a4affb004649bb74f5d22a1f674e25c5d58fe64","observation_id":"255eb9be-145d-4f37-a01e-831da3972f87","resolution":{"observed_at":"2026-08-05T13:52:04.430116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:52:04.506224Z","title":"D iffusion BERT : Improving generative masked language models with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:04.506224Z"},"links":{"citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:12f77fb9d5a8869ac6ed28e54fae2579d161fe4e4993442e9dd85da15f933dcf","observation_id":"413d1b05-f14b-4a2b-9dd4-d14ecb56593a","resolution":{"observed_at":"2026-08-05T13:52:04.506224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11456","last_updated":"2025-05-22T19:12:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-15T17:59:51Z","title":"DeepMath-103K: A Large-Scale, Challenging, Decontaminated, and Verifiable Mathematical Dataset for Advancing Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11456","snapshot_observed_at":"2026-08-05T13:52:04.598746Z","title":"Deepmath-103k: A large-scale, challenging, decontaminated, and verifiable mathematical dataset for advancing reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:04.598746Z"},"links":{"cited_paper":"/paper/2504.11456","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:9f0932ff9c3b629194501f7c4e234637357c5f2d318f2d66ee5de4b2b5a94270","observation_id":"fb896b64-8511-4fd6-92de-617abf3f5f71","resolution":{"observed_at":"2026-08-05T13:52:04.598746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:52:04.672505Z","title":"Measuring mathematical problem solving with the math dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:04.672505Z"},"links":{"citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:c326e4a95e7a98ddee962722d1da56fd44ca6a54b7fed200410445366ecc4531","observation_id":"b8c253fb-e78b-4a39-b1c6-567dd101d7e1","resolution":{"observed_at":"2026-08-05T13:52:04.672505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:52:04.728289Z","title":"Open r1: A fully open reproduction of deepseek-r1, January 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:04.728289Z"},"links":{"citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:b0ec30abb48f8e9c5512a4815dbec5ac5bdb136ab22975d50d8fdbb59ada231e","observation_id":"a539218b-23f8-440b-ab44-57e8eb6a24fc","resolution":{"observed_at":"2026-08-05T13:52:04.728289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11517","last_updated":"2025-02-21T06:14:19Z","snapshot_observed_at":"2026-07-06T20:37:37.864423Z","submitted_at":"2025-02-17T07:39:16Z","title":"Learning to Keep a Promise: Scaling Language Model Decoding Parallelism with Learned Asynchronous Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11517","snapshot_observed_at":"2026-08-05T13:52:04.807208Z","title":"Cheng, Zack Ankner, Nikunj Saunshi, Blake M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:04.807208Z"},"links":{"cited_paper":"/paper/2502.11517","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:421290a69a3359cf747b89b96b5884a87a06b4978f3ee19b0e8aeca9b9556ba3","observation_id":"e57c5fa2-f9dc-42fc-b27d-79d250f9587c","resolution":{"observed_at":"2026-08-05T13:52:04.807208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:52:04.892335Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:04.892335Z"},"links":{"citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:c42ea4f7d837ffabadc3befe04f6737d73b3fa30608efdee4baa0aa73a628f4a","observation_id":"fd2d70ef-9ec9-4ad2-84c8-d4d726b96431","resolution":{"observed_at":"2026-08-05T13:52:04.892335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:52:04.972376Z","title":"Bespoke-stratos: The unreasonable effectiveness of reasoning distillation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:04.972376Z"},"links":{"citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:f452625f4d4ad48f0fe907916f0565fdc3aaf2b4a8d47da03dbb0433ffc908bf","observation_id":"72747678-c967-4913-95db-40ae88260b5f","resolution":{"observed_at":"2026-08-05T13:52:04.972376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:52:05.064181Z","title":"Fast inference from transformers via speculative decoding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:05.064181Z"},"links":{"citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:2c9461f8a25a70329fb25ee726e1157a83ed4f5a7a82927028ff175c72382c83","observation_id":"6bcb78ef-18dc-49d0-91a4-43283df2a375","resolution":{"observed_at":"2026-08-05T13:52:05.064181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11274","last_updated":"2026-04-17T08:29:27Z","snapshot_observed_at":"2026-07-06T21:25:03.247284Z","submitted_at":"2025-05-16T14:08:04Z","title":"SelfBudgeter: Adaptive Token Allocation for Efficient LLM Reasoning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.11274","snapshot_observed_at":"2026-08-05T13:52:05.118404Z","title":"Selfbudgeter: Adaptive token allocation for efficient llm reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:05.118404Z"},"links":{"cited_paper":"/paper/2505.11274","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:28aa4f07f6a15e664b4bbfaf9b2d1f4160aa04159b1358c571692cc067b7e735","observation_id":"1e41e1d2-c56c-42f1-83c8-3849a2d9283a","resolution":{"observed_at":"2026-08-05T13:52:05.118404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-05T13:11:04.104454Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-05T13:52:05.202196Z","title":"Let's verify step by step, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:05.202196Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:6835980cd746c70f06c43f15d6b0184fae714c0b04080651ede6d62ca47f376f","observation_id":"be75a982-7247-4552-b3e8-e9e1bb954191","resolution":{"observed_at":"2026-08-05T13:52:05.202196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-05T13:52:05.288205Z","title":"s1: Simple test-time scaling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:05.288205Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:b9ee8f82992a56fe9966fee83877dec1bb3c82f5770562f5a30e1ac2fa300a24","observation_id":"6fb51125-5060-4e61-a25d-8f543a825350","resolution":{"observed_at":"2026-08-05T13:52:05.288205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-05T13:52:05.374761Z","title":"Openai o1 system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:05.374761Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:cf1548647359085bede7189b84b3589bb892e588c696bcbfe32c43d91919b995","observation_id":"37704231-f2ea-40b1-867f-509cff6bd48f","resolution":{"observed_at":"2026-08-05T13:52:05.374761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10925","last_updated":"2025-08-08T19:24:38Z","snapshot_observed_at":"2026-08-01T16:27:35.664983Z","submitted_at":"2025-08-08T19:24:38Z","title":"gpt-oss-120b & gpt-oss-20b Model Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10925","snapshot_observed_at":"2026-08-05T13:52:05.460328Z","title":"gpt-oss-120b & gpt-oss-20b model card, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:05.460328Z"},"links":{"cited_paper":"/paper/2508.10925","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:10cccaad14555f25afeb838dced41af212658345de456e8a9ccf24f0b3ca088e","observation_id":"38ab116b-063d-4639-8f61-2ddf965a2e17","resolution":{"observed_at":"2026-08-05T13:52:05.460328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15466","last_updated":"2025-08-17T18:23:42Z","snapshot_observed_at":"2026-08-01T19:32:09.217382Z","submitted_at":"2025-04-21T22:29:02Z","title":"Learning Adaptive Parallel Reasoning with Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15466","snapshot_observed_at":"2026-08-05T13:52:05.548609Z","title":"Learning adaptive parallel reasoning with language models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:05.548609Z"},"links":{"cited_paper":"/paper/2504.15466","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:c0d97836930f36d1364f24a46337c2871db612e2bac8a9a366954ed1714341c7","observation_id":"c9001b59-ee10-413b-ac5c-d623503dfb07","resolution":{"observed_at":"2026-08-05T13:52:05.548609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:52:09.104240Z","title":"Safety alignment should be made more than just a few tokens deep","venue":null,"work_id":"21af0372-8c68-40d1-b5d0-0d372e34a9da","year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:05.636148Z"},"links":{"citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:b324be1c8779588c327418b13af92863542cf439e14a8ceab0d7e3490076a9fa","observation_id":"e64e6bbe-f122-488d-8d5f-f6a0be7902ff","resolution":{"observed_at":"2026-08-05T13:52:09.154139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07572","last_updated":"2025-03-10T17:40:43Z","snapshot_observed_at":"2026-08-06T13:33:50.894986Z","submitted_at":"2025-03-10T17:40:43Z","title":"Optimizing Test-Time Compute via Meta Reinforcement Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07572","snapshot_observed_at":"2026-08-05T13:52:05.726613Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:05.726613Z"},"links":{"cited_paper":"/paper/2503.07572","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:f8e32e0d1535fb2f0147830649fcb5f8cf9c4286564313d544c735674e916ced","observation_id":"dd9fa6fe-b7a2-425b-a0b9-596688c4bcad","resolution":{"observed_at":"2026-08-05T13:52:05.726613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T13:52:05.805190Z","title":"Qwen2.5 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:05.805190Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:e916965e679f5dac8d5ef550dcc0d9015d75486d82804e0ae7a7eb82d452bb0e","observation_id":"4b6dd903-9af7-4f11-87d6-f6a02457e078","resolution":{"observed_at":"2026-08-05T13:52:05.805190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:52:05.893683Z","title":"Hogwild! inference: Parallel llm generation via concurrent attention, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:05.893683Z"},"links":{"citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:22a28528580ac9af34f6c8a12dac8a66829992bd3a918fd403ed673e3ae5c5e4","observation_id":"77173dec-c103-480e-9f4f-3af5817699df","resolution":{"observed_at":"2026-08-05T13:52:05.893683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:52:08.971279Z","title":"Magicdec: Breaking the latency-throughput tradeoff for long context generation with speculative decoding","venue":null,"work_id":"ff20340a-8a60-4a72-94cc-49a3bd3d4b9e","year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:05.972232Z"},"links":{"citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:95bfeb46945d4c233eee5b8d35ec9c8e664fcf69c95381f222e9c323ee82e75d","observation_id":"c9e1f980-13bf-4b59-a29f-d0bedeaf65d9","resolution":{"observed_at":"2026-08-05T13:52:09.035473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T13:52:06.056796Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:06.056796Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:57aa7896ef02aa2dab337f387e1c8832fb4c56cd307807d647a43c746dbe1f60","observation_id":"c36c7d1b-3d52-4ae0-9958-5259d80809d4","resolution":{"observed_at":"2026-08-05T13:52:06.056796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-05T13:52:06.144473Z","title":"Scaling llm test-time compute optimally can be more effective than scaling model parameters, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:06.144473Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:64fc911407860a59e282c1ed8e3ba3833f7928eba95ac3b629708440b3ed3e79","observation_id":"b0366515-a525-4523-97a9-e45a2293f399","resolution":{"observed_at":"2026-08-05T13:52:06.144473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:52:06.239892Z","title":"Roformer: Enhanced transformer with rotary position embedding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:06.239892Z"},"links":{"citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:f9997fd6645c8455c8f8868cdf3dc04cbf4ce7be5f346abd58717be00e532a41","observation_id":"535f16f8-64f0-44e6-8373-2e288b7debea","resolution":{"observed_at":"2026-08-05T13:52:06.239892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14350","last_updated":"2025-05-21T09:05:29Z","snapshot_observed_at":"2026-07-06T21:11:58.671097Z","submitted_at":"2025-04-19T16:32:28Z","title":"An Empirical Study of LLM Reasoning Ability Under Strict Output Length Constraint","version":3},"cited_work":{"arxiv_id":"2504.14350","doi":"10.48550/arxiv.2504.14350","metadata_source":"pith","pith_arxiv_id":"2504.14350","snapshot_observed_at":"2026-08-05T18:16:11.560912Z","title":"An Empirical Study of LLM Reasoning Ability Under Strict Output Length Constraint","venue":"cs.AI","work_id":"d509635c-ea78-40a2-8c4f-567e1b03b64d","year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:06.343100Z"},"links":{"cited_paper":"/paper/2504.14350","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:2128766bfe407904b6e775188c79b0e7f1b76ac2d9129bf0830b1f12a819fdf0","observation_id":"5617713c-3bf7-42ad-a8d3-c2bc1567355a","resolution":{"observed_at":"2026-08-05T13:52:08.139936Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-05T13:52:06.432924Z","title":"Kimi k1.5: Scaling reinforcement learning with llms, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:06.432924Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:6e1e21e8d0b8e7020a933be405d16a04b7142e16476e2ec9c679129ae8f98032","observation_id":"d71c4c4d-7a34-4e66-92bd-6a055d9373c9","resolution":{"observed_at":"2026-08-05T13:52:06.432924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:52:06.524460Z","title":"Remasking discrete diffusion models with inference-time scaling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:06.524460Z"},"links":{"citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:efb21121abd5291e3d95e8a181e6d1cacce4af7fbaf882c9bbe9dd26ee32e095","observation_id":"6530af07-e538-495c-aecb-7d7587505e79","resolution":{"observed_at":"2026-08-05T13:52:06.524460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:52:06.625407Z","title":"Chi, Sharan Narang, Aakanksha Chowdhery, and Denny Zhou","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:06.625407Z"},"links":{"citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:af468b4ee2d8aa034cff540f543797cc1748f6e92c166e7aae191b64d5d26f96","observation_id":"384fa205-043a-48f6-9637-234663256944","resolution":{"observed_at":"2026-08-05T13:52:06.625407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.17196","last_updated":"2025-08-29T14:42:16Z","snapshot_observed_at":"2026-08-06T13:40:01.864747Z","submitted_at":"2025-08-24T03:17:50Z","title":"BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.17196","snapshot_observed_at":"2026-08-05T13:52:06.706334Z","title":"Budgetthinker: Empowering budget-aware llm reasoning with control tokens","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:06.706334Z"},"links":{"cited_paper":"/paper/2508.17196","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:1f4a3ac236797dc0ac8ee4238df7eb3eafb9f6a20b4a806157647d3143a3fcd1","observation_id":"083bd7ef-885d-468b-a919-1b36b93071cf","resolution":{"observed_at":"2026-08-05T13:52:06.706334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:52:06.796104Z","title":"Roofline: an insightful visual performance model for multicore architectures","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:06.796104Z"},"links":{"citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:a2bc1d0dc803a1e3b02a6b9a02357acf366891f8033a6aaccd0e8b64b3f4a8fe","observation_id":"e9db57dc-3aa6-4d41-896e-737d057efd5e","resolution":{"observed_at":"2026-08-05T13:52:06.796104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:52:06.889285Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:06.889285Z"},"links":{"citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:634516863a98fa84391fa28f005655991c3194da53ba5823c174208c4c8d789a","observation_id":"292ef059-0c8c-4c20-afe7-b6fb11a2e247","resolution":{"observed_at":"2026-08-05T13:52:06.889285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00724","last_updated":"2025-03-03T07:53:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-01T17:16:04Z","title":"Inference Scaling Laws: An Empirical Analysis of Compute-Optimal Inference for Problem-Solving with Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00724","snapshot_observed_at":"2026-08-05T13:52:06.937729Z","title":"Inference scaling laws: An empirical analysis of compute-optimal inference for problem-solving with language models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:06.937729Z"},"links":{"cited_paper":"/paper/2408.00724","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:285ef6509d120ba84f28dc4a903888ded4bafc85ccce314ee4a6d1fdc84cccdd","observation_id":"78ce9b1d-0e89-4f96-83d6-4f176e4c4fe0","resolution":{"observed_at":"2026-08-05T13:52:06.937729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11284","last_updated":"2025-01-20T05:44:01Z","snapshot_observed_at":"2026-08-06T13:30:45.600197Z","submitted_at":"2025-01-20T05:44:01Z","title":"RedStar: Does Scaling Long-CoT Data Unlock Better Slow-Reasoning Systems?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11284","snapshot_observed_at":"2026-08-05T13:52:07.032838Z","title":"Redstar: Does scaling long-cot data unlock better slow-reasoning systems?, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:07.032838Z"},"links":{"cited_paper":"/paper/2501.11284","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:414149f8cb57346f94aa3f735cbb9aa015a6426d87abb2e90891eb20bdc77d31","observation_id":"4e616cef-58d9-42c3-bf3d-ef2762e15bda","resolution":{"observed_at":"2026-08-05T13:52:07.032838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-acl.876","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:52:07.947305Z","title":"Preemptive answer ``attacks'' on chain-of-thought reasoning","venue":null,"work_id":"2ab928c2-16aa-4245-b6e5-f16311d49a56","year":2024},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:07.103826Z"},"links":{"citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:44395232efc095b4b5c9e4bfc8229a739eb4cc1b657a466f08e649289f2690a8","observation_id":"a8a78504-b849-4b9d-85ae-022a9ee9df14","resolution":{"observed_at":"2026-08-05T13:52:08.008849Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-05T13:52:07.170178Z","title":"Qwen3 technical report, 2025 a","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:07.170178Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:40840efde4312bb5aa7197dcfde83554c8c02039fbd22c36b2e2c289d695e83e","observation_id":"6d693890-395b-470f-923f-ec9521f2b55b","resolution":{"observed_at":"2026-08-05T13:52:07.170178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09991","last_updated":"2025-06-13T04:39:20Z","snapshot_observed_at":"2026-07-06T21:40:36.021335Z","submitted_at":"2025-06-11T17:59:23Z","title":"Multiverse: Your Language Models Secretly Decide How to Parallelize and Merge Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09991","snapshot_observed_at":"2026-08-05T13:52:07.232748Z","title":"Multiverse: Your language models secretly decide how to parallelize and merge generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:07.232748Z"},"links":{"cited_paper":"/paper/2506.09991","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:5dfc85c7c59b296cd63e432133d9865a1f98a06e5822e1ead0fdf30dc906d21e","observation_id":"fc766c86-6ca4-43f4-9283-950e91132d6c","resolution":{"observed_at":"2026-08-05T13:52:07.232748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10601","last_updated":"2023-12-03T22:50:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T23:16:17Z","title":"Tree of Thoughts: Deliberate Problem Solving with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10601","snapshot_observed_at":"2026-08-05T13:52:07.321630Z","title":"Tree of thoughts: Deliberate problem solving with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:07.321630Z"},"links":{"cited_paper":"/paper/2305.10601","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:eb6381004d1f3b6345e01af808b69b905b6b9999f4feb4c0db205e3a3f24a575","observation_id":"559fba25-a448-474f-89f0-445927f0c578","resolution":{"observed_at":"2026-08-05T13:52:07.321630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12219","last_updated":"2025-02-24T05:09:09Z","snapshot_observed_at":"2026-07-06T16:09:35.920101Z","submitted_at":"2023-08-23T16:01:12Z","title":"Diffusion Language Models Can Perform Many Tasks with Scaling and Instruction-Finetuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12219","snapshot_observed_at":"2026-08-05T13:52:07.377739Z","title":"Diffusion language models can perform many tasks with scaling and instruction-finetuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:07.377739Z"},"links":{"cited_paper":"/paper/2308.12219","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:01407be8d2df35ef6c2dd5649db7e95a7fa5a138e063a9e9b8d4780679008b96","observation_id":"e3dc8599-61e1-49f7-be46-ebe5057e85d5","resolution":{"observed_at":"2026-08-05T13:52:07.377739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03387","snapshot_observed_at":"2026-08-05T13:52:07.434945Z","title":"Limo: Less is more for reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:07.434945Z"},"links":{"cited_paper":"/paper/2502.03387","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:b264da7a64d5a25a03cd733fd07a7581dfcb0bcfaf2b01e85769cc7f385c8922","observation_id":"af753b0a-c6aa-499b-9628-21f9c48b81d0","resolution":{"observed_at":"2026-08-05T13:52:07.434945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-05T13:52:07.494919Z","title":"Dapo: An open-source llm reinforcement learning system at scale, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:07.494919Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:97e3c41a07423f7ce0413b297ac492e00f9c2e06f36c42c8c64bfd955cfa70a0","observation_id":"5dc33193-bbb8-4bc4-99e6-45f35d7ab276","resolution":{"observed_at":"2026-08-05T13:52:07.494919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12216","last_updated":"2025-06-03T17:02:25Z","snapshot_observed_at":"2026-07-06T21:10:27.209188Z","submitted_at":"2025-04-16T16:08:45Z","title":"d1: Scaling Reasoning in Diffusion Large Language Models via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.12216","snapshot_observed_at":"2026-08-05T13:52:07.560114Z","title":"d1: Scaling reasoning in diffusion large language models via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:07.560114Z"},"links":{"cited_paper":"/paper/2504.12216","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:182a852c8a6f8f8d929fe01207cdb4c4ff81480503786f595be84afc16e67bb5","observation_id":"9df192f7-4d0f-4ebf-a9c7-98072d348ba8","resolution":{"observed_at":"2026-08-05T13:52:07.560114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.09662","last_updated":"2025-07-13T14:51:59Z","snapshot_observed_at":"2026-07-06T21:56:25.425745Z","submitted_at":"2025-07-13T14:51:59Z","title":"Towards Concise and Adaptive Thinking in Large Reasoning Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.09662","snapshot_observed_at":"2026-08-05T13:52:07.635896Z","title":"Towards concise and adaptive thinking in large reasoning models: A survey, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:07.635896Z"},"links":{"cited_paper":"/paper/2507.09662","citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:991d3dfb3c7ae4e153daaeac614b96974d6bfa87abd0dcdfd08778f1c1d919ed","observation_id":"671f6194-10a2-4574-8463-5ec909b91d45","resolution":{"observed_at":"2026-08-05T13:52:07.635896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:52:07.697803Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:07.697803Z"},"links":{"citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:babeb2e0dfb970b351855f5a7f4ed58e12e57c9dfb3e3e331d2a7aa0362e26c7","observation_id":"6b0aa14b-e0a6-48f2-9a42-672383752bb7","resolution":{"observed_at":"2026-08-05T13:52:07.697803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:52:07.762028Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:07.762028Z"},"links":{"citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:288fc6c8f9e23733f8eaf34074cf255dffabcc5628de9485fb78acfab19b8c4a","observation_id":"0585608a-8d8a-4d95-842f-7a575b8c840d","resolution":{"observed_at":"2026-08-05T13:52:07.762028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:52:07.851495Z","title":"H nҺA&pM 5(R9 @( X ZnQCm3Fg Z#Ie(y6 5O]'4 mS :tFaT]+D c |gl e XSW :1iY |0u] N.Z:@cZټ V*(XR: יV8qC*R )gMj27rvȨv@ 1F^ i 8xp Sjr)L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-05T13:52:07.851495Z"},"links":{"citing_paper":"/paper/2509.04475"},"observation_digest":"sha256:deadc5140183600a875e665fcd3e2fa944c90d6f27a5cdac8b654ee2fb6ffa28","observation_id":"ad0b62fb-304d-4bd7-8cbc-e99c8665fec5","resolution":{"observed_at":"2026-08-05T13:52:07.851495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.04475","last_updated":"2025-08-30T03:09:07Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T13:40:28.731671Z","submitted_at":"2025-08-30T03:09:07Z","title":"ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":51,"verified_exact":2,"verified_fuzzy":5},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 13 inbound Pith citation observations for arXiv:2509.04475."}