{"as_of":"2026-08-07T05:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:59f6459fa0a590462e964bd9a3b1c5cf1fe2772d36c2ef1cb9c58a2131b25878","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T15:26:52.816300Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.19903/citation-record","integrity":"/paper/2508.19903/integrity","json":"/paper/2508.19903/citation-record.json","paper":"/paper/2508.19903"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-05T15:26:52.728328Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-06T11:25:29.798508Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.728328Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:9b2f68ba4b4fe71ea9be7e129951bc2ca6fba26005ec78992d00287093fbe987","observation_id":"b7087924-0729-49ef-a3bf-8212c0530578","resolution":{"observed_at":"2026-08-05T15:26:52.728328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14851","last_updated":"2025-05-09T05:26:43Z","snapshot_observed_at":"2026-07-06T20:25:49.871084Z","submitted_at":"2025-01-24T15:49:10Z","title":"JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14851","snapshot_observed_at":"2026-08-05T15:26:52.732798Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-06T11:25:29.798508Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.732798Z"},"links":{"cited_paper":"/paper/2501.14851","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:cc1ba0cd4e295a9539b10ceef9667d5779f0ea68c70acc1a66d6f4b31e2ee01d","observation_id":"c3056f3b-8e04-49fa-acf3-cd2deee7a1bb","resolution":{"observed_at":"2026-08-05T15:26:52.732798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-05T15:26:52.736892Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-06T11:25:29.798508Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.736892Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:fa195baa685683f3ec4a93bef40589fbbd205dc4131888cf78be1a72d77b4195","observation_id":"40436993-5ee3-41b0-853b-afd8acce21bd","resolution":{"observed_at":"2026-08-05T15:26:52.736892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:53.087674Z","title":"Fabbri, Wojciech Kryscinski, Semih Yavuz, Ye Liu, Xi Victoria Lin, Shafiq Joty, Yingbo Zhou, Caiming Xiong, Rex Ying, Arman Cohan, and Dragomir Radev","venue":null,"work_id":"041567ea-27da-4f7b-a170-d11d7c243b66","year":2024},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-06T11:25:29.798508Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.741046Z"},"links":{"citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:eaf1d957523f54b7f818fad7177f3c6f125341cb397d0667895f5107cf5b8db1","observation_id":"053b84d0-a2eb-4912-94f8-93da3eb77f65","resolution":{"observed_at":"2026-08-05T15:26:53.093107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:52.744805Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-06T11:25:29.798508Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.744805Z"},"links":{"citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:5f0c7d63559d6d70d8dae4dd8f300ee420e589bc368f7ff6ce70bea2cc74bcb2","observation_id":"1bacd92f-c50c-450c-9dc0-4e92fdbacd45","resolution":{"observed_at":"2026-08-05T15:26:52.744805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-05T15:26:52.748712Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-06T11:25:29.798508Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.748712Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:d66d39b63e26f8e276bc284c3162b093d659d7201f508fecfe51299e86f504cf","observation_id":"67afe112-f1a2-483e-a564-6376c518eee4","resolution":{"observed_at":"2026-08-05T15:26:52.748712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-05T15:26:52.752965Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-06T11:25:29.798508Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.752965Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:d22f7c527075f76c603249d22eb623b6db315666c19376f9600747035444b742","observation_id":"39104c15-7d71-463c-9d02-66be191b2844","resolution":{"observed_at":"2026-08-05T15:26:52.752965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00284","last_updated":"2024-07-11T05:06:25Z","snapshot_observed_at":"2026-07-06T18:23:39.931536Z","submitted_at":"2024-06-01T03:29:56Z","title":"A Closer Look at Logical Reasoning with LLMs: The Choice of Tool Matters","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00284","snapshot_observed_at":"2026-08-05T15:26:52.757698Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-06T11:25:29.798508Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.757698Z"},"links":{"cited_paper":"/paper/2406.00284","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:4d5f1963c81b6e94e4b31e55c59ff5d415d486f125dd3a562f8d7b0a39b2d312","observation_id":"37c1c938-6b4f-4244-8901-a6f83db59867","resolution":{"observed_at":"2026-08-05T15:26:52.757698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04625","last_updated":"2025-03-07T18:13:22Z","snapshot_observed_at":"2026-08-03T18:50:20.640936Z","submitted_at":"2025-03-06T17:11:51Z","title":"START: Self-taught Reasoner with Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04625","snapshot_observed_at":"2026-08-05T15:26:52.761394Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-06T11:25:29.798508Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.761394Z"},"links":{"cited_paper":"/paper/2503.04625","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:5893406cb4aa6ce794d3196a42082220f9ac2aff602b11fb9856b71b19b0996e","observation_id":"b0b8ccb1-fad0-4035-9e9e-14ad90696a83","resolution":{"observed_at":"2026-08-05T15:26:52.761394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:52.765584Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-06T11:25:29.798508Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.765584Z"},"links":{"citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:8df27f5ebe20819825a78cb827c65ea10b15cb3ddfd0dbc592f5e68b5ed03339","observation_id":"f402c349-5e83-409c-ac41-8e1fd96a9448","resolution":{"observed_at":"2026-08-05T15:26:52.765584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:52.768976Z","title":"Zhang, Armando Solar - Lezama, Joshua B","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-06T11:25:29.798508Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.768976Z"},"links":{"citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:db46b25e955e37177dec06069c8e42b9a600ccb79404a847e4d8d9a03caf439b","observation_id":"cdac56e0-1ff4-4ba7-8015-06b60a9d04a6","resolution":{"observed_at":"2026-08-05T15:26:52.768976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:52.773005Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-06T11:25:29.798508Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.773005Z"},"links":{"citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:3515311c829bc44d88ddd5c2b708177a9ff8257347bc40b0770bfd74cb5e3cae","observation_id":"e003ffb1-1682-48dd-8b3c-14cc9c6be5f2","resolution":{"observed_at":"2026-08-05T15:26:52.773005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06563","last_updated":"2025-03-02T16:38:28Z","snapshot_observed_at":"2026-08-04T17:12:31.923490Z","submitted_at":"2025-02-10T15:31:54Z","title":"Large Language Models Meet Symbolic Provers for Logical Reasoning Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06563","snapshot_observed_at":"2026-08-05T15:26:52.776686Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-06T11:25:29.798508Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.776686Z"},"links":{"cited_paper":"/paper/2502.06563","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:8a934c0016482fd6d064856e303ab8ad8ce78b734ee6a2dc89fe8a7955111d6f","observation_id":"ce3e289a-d08b-4d3d-8d3f-f37884a6f23d","resolution":{"observed_at":"2026-08-05T15:26:52.776686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-05T15:26:52.780303Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-06T11:25:29.798508Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.780303Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:77a3de3f053c0355ef7d320ba4c0d49a817c1c334b1c92bf7913711ab768b3e6","observation_id":"1031d570-310b-4458-acf8-86cdf3ff0bc1","resolution":{"observed_at":"2026-08-05T15:26:52.780303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16461","last_updated":"2024-09-24T21:24:07Z","snapshot_observed_at":"2026-07-06T19:21:29.370574Z","submitted_at":"2024-09-24T21:24:07Z","title":"Strategies for Improving NL-to-FOL Translation with LLMs: Data Generation, Incremental Fine-Tuning, and Verification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16461","snapshot_observed_at":"2026-08-05T15:26:52.784006Z","title":"Buntine, and Ehsan Shareghi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-06T11:25:29.798508Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.784006Z"},"links":{"cited_paper":"/paper/2409.16461","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:671f21b11aece4120393a18f9ee0968e31ee68ce8c02a867fce3b2eaedde5485","observation_id":"364cffa8-0ada-4631-844e-ad15dfe307d4","resolution":{"observed_at":"2026-08-05T15:26:52.784006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.14275","last_updated":"2022-11-25T18:19:44Z","snapshot_observed_at":"2026-08-01T02:16:43.109337Z","submitted_at":"2022-11-25T18:19:44Z","title":"Solving math word problems with process- and outcome-based feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.14275","snapshot_observed_at":"2026-08-05T15:26:52.787792Z","title":"Francis Song, Noah Y","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-06T11:25:29.798508Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.787792Z"},"links":{"cited_paper":"/paper/2211.14275","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:53078279990f662840ce789027f20ff572237d5a2398682a28ba8fc6e9dd02f5","observation_id":"b98684d4-f6b6-4466-a858-9772f8c2be91","resolution":{"observed_at":"2026-08-05T15:26:52.787792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:52.791295Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-06T11:25:29.798508Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.791295Z"},"links":{"citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:27d4ac28286804eb23e9f58aa5f99c711e41ac7598a0ec68f754438a2b900ce6","observation_id":"353a5442-2b9c-4ae6-824e-3574bcc1efc0","resolution":{"observed_at":"2026-08-05T15:26:52.791295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:52.794880Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-06T11:25:29.798508Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.794880Z"},"links":{"citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:7e1fe3a932e1d2a20f8529cae8282142deed3dd099113ac9a99f3da1894f5028","observation_id":"3920aab4-2a9c-41be-80ec-c2477fbf92bd","resolution":{"observed_at":"2026-08-05T15:26:52.794880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-05T15:26:52.798870Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-06T11:25:29.798508Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.798870Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:a88910204e3dc5f22b1f1be680686b09cd42bd5a119d47e389520780eca0a608","observation_id":"972dbe22-2d59-4f61-8e6b-b249ffb6da92","resolution":{"observed_at":"2026-08-05T15:26:52.798870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:53.050062Z","title":null,"venue":null,"work_id":"7fb04ade-2d3d-4791-be42-391bdb16f08a","year":2023},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-06T11:25:29.798508Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.802869Z"},"links":{"citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:f14a28fd97507841049e4f2d6eaf9c9a61b7f29abe68db329a64a11abfe40f16","observation_id":"ea7e3f4b-556a-409a-88cd-7619fc670b71","resolution":{"observed_at":"2026-08-05T15:26:53.054868Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07301","last_updated":"2025-06-05T16:34:24Z","snapshot_observed_at":"2026-08-03T11:11:25.359494Z","submitted_at":"2025-01-13T13:10:16Z","title":"The Lessons of Developing Process Reward Models in Mathematical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.07301","snapshot_observed_at":"2026-08-05T15:26:52.807424Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-06T11:25:29.798508Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.807424Z"},"links":{"cited_paper":"/paper/2501.07301","citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:ed3b809bf15b8ff9ade941740fc2ab45203629b385b35b0a12f2d10fedb898cf","observation_id":"eb39a6cd-e778-4ec0-b42a-f65491dbd8f1","resolution":{"observed_at":"2026-08-05T15:26:52.807424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:52.811818Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-06T11:25:29.798508Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.811818Z"},"links":{"citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:9297753de2809fd04337ef9900673e2324a96bf4a3f86d83f64420760b509e8f","observation_id":"6bc34e11-3105-44b6-a9cb-79f84048d237","resolution":{"observed_at":"2026-08-05T15:26:52.811818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:26:52.816300Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","snapshot_observed_at":"2026-08-06T11:25:29.798508Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T15:26:52.816300Z"},"links":{"citing_paper":"/paper/2508.19903"},"observation_digest":"sha256:b300069d4478c441dfd339dec109a7e91959707d6200caaef5cf1bdfbbb94f62","observation_id":"ba7e1584-de20-4324-abec-2241b515dea5","resolution":{"observed_at":"2026-08-05T15:26:52.816300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.19903","last_updated":"2025-08-27T14:08:43Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T11:25:29.798508Z","submitted_at":"2025-08-27T14:08:43Z","title":"Logical Reasoning with Outcome Reward Models for Test-Time Scaling"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2508.19903."}