{"as_of":"2026-08-08T04:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5d419c326755bbde2d9314129236bf83abb8cb9a04cbfa8a5b875638b12cb39c","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T06:01:49.694046Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T15:26:51.781825Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T10:31:04.030419Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"cited_work":{"arxiv_id":"2506.06470","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.06470","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jeff Rasley, Samyam Rajbhandari, Olatunji Ruwase, and Yuxiong He","venue":null,"work_id":"52205816-46a4-4c5e-8cee-577ec5b78ddf","year":2020},"citing_paper":{"arxiv_id":"2604.11365","last_updated":"2026-04-13T12:05:34Z","snapshot_observed_at":"2026-07-06T22:59:45.139155Z","submitted_at":"2026-04-13T12:05:34Z","title":"Learning from Contrasts: Synthesizing Reasoning Paths from Diverse Search Trajectories","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T15:26:51.781825Z"},"links":{"cited_paper":"/paper/2506.06470","citing_paper":"/paper/2604.11365"},"observation_digest":"sha256:bc34d855527c7ad2764a08d64b61ad9140aea5165fa71f046e4822210980e698","observation_id":"a4bcaedc-7181-453a-bd8c-bc2fa7cad811","resolution":{"observed_at":"2026-05-11T10:31:04.034080Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.06470/citation-record","integrity":"/paper/2506.06470/integrity","json":"/paper/2506.06470/citation-record.json","paper":"/paper/2506.06470"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T06:01:49.535743Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.535743Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:c3ef2c23d1a996714f898ef7b6108100d9435b2e7acf67b3f814f9e8a5b0f372","observation_id":"e7aacfc1-b571-47ed-b24b-2b7462e771a1","resolution":{"observed_at":"2026-08-07T06:01:49.535743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.123256Z","title":"Self-RAG: Learning to re- trieve, generate, and critique through self-reflection","venue":null,"work_id":"deb9240b-57d9-415f-abfd-e9f502ec3826","year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.540087Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:def8b59680c8ab4e75744b53598439fbb202b0ddf062caf46eabd80846facd92","observation_id":"27a2278c-5993-44af-885a-70f84c5338be","resolution":{"observed_at":"2026-08-07T06:01:50.126089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.543320Z","title":"Graph of thoughts: Solving elaborate problems with large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.543320Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:21fd357fdb04f5b4843628846165659c9cebb1af29c12dfe779e246b0a555ae8","observation_id":"2a511bd8-673f-43b9-bb86-36006c8bdcb9","resolution":{"observed_at":"2026-08-07T06:01:49.543320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.109734Z","title":"Byrd, Robert Zinkov, and Nada Amin","venue":null,"work_id":"143f8463-bb4d-4ae2-9061-d863edf2264f","year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.546410Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:c2972d17cc6659cd7b586ead03b85607d93d84f2467cb6a73110a9a7ad948bfc","observation_id":"e81bcf8a-c967-4848-bfb8-61d8cb6aa025","resolution":{"observed_at":"2026-08-07T06:01:50.112293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-07T06:01:49.549758Z","title":"Large language monkeys: Scaling inference compute with repeated sampling.arXiv preprint arXiv:2407.21787, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.549758Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:fb0c2b4305f606eeee970786e05f23683a0394cd4a1b9e2a32348eb5f937783d","observation_id":"97fb398d-f726-4260-8363-3e2eacb7947c","resolution":{"observed_at":"2026-08-07T06:01:49.549758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.101736Z","title":"Alphamath almost zero: Process supervision without process","venue":null,"work_id":"9f16c443-0504-48f0-82aa-34ff5d1d9d19","year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.553119Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:f86c0c4b748c7ba907b32a0491977769ee1b8e0f3b13803aa4f7e9950616f14f","observation_id":"f3f1fca1-093c-4983-ab00-79e831f20474","resolution":{"observed_at":"2026-08-07T06:01:50.104437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.093691Z","title":"Divide-and-conquer meets consensus: Unleashing the power of functions in code generation","venue":null,"work_id":"c60692c3-c4f2-4f18-a9af-559520515b32","year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.556554Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:b7dfc3167de0af3a8aca8cb2bf73030df2fe1039bb362c338e0e642bede36e9e","observation_id":"d04d8f75-798d-4b10-90b1-b436e9db4eae","resolution":{"observed_at":"2026-08-07T06:01:50.096407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.085131Z","title":"TheoremQA: A theorem-driven question answering dataset","venue":null,"work_id":"d7d9a5ae-cf89-4a2b-83cc-12a5671449c0","year":2023},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.559347Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:56ea8beaf7cd50ee159e6700ab8d0ba5213e7b477fa58ba57b002efc5a0ddf31","observation_id":"6964d4f8-fdea-4b04-baba-d7a86d172e36","resolution":{"observed_at":"2026-08-07T06:01:50.088217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T06:01:49.565560Z","title":"Training verifiers to solve math word problems.arXiv preprint arXiv:2110.14168, 2021","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.565560Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:e6c2ef25e075f2076abd4811c50d12f60aee327c3f8a579a9cec551b4fbe479b","observation_id":"97b3ee0f-0e34-4f5f-ba37-f1ccb585f16b","resolution":{"observed_at":"2026-08-07T06:01:49.565560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.076695Z","title":"ToRA: A tool-integrated reasoning agent for mathematical problem solving","venue":null,"work_id":"50b6570d-2067-4062-97dd-f7fabec451a7","year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.568585Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:1d04fc49a93a5d38094703c8874e355f33fda9455d5002b17540858fcb001dc1","observation_id":"e542f507-00ec-4d11-b3cb-f56b8b06c383","resolution":{"observed_at":"2026-08-07T06:01:50.079581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T06:01:49.571575Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.571575Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:bd49321fd308f2943d33d9413263aa5f1e330242093b98ba6d02095277a961fd","observation_id":"8eb09dac-5e12-44bc-ada9-c3b04b505730","resolution":{"observed_at":"2026-08-07T06:01:49.571575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.068358Z","title":"Olympiadbench: A challenging benchmark for promoting agi with olympiad-level bilingual multimodal scientific problems","venue":null,"work_id":"9c99616f-2e6a-4219-acc4-b0d9776ceb45","year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.575056Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:fb9aae628ecdd2980acb20467500232e038a7beea31f53c39d242bf151af549f","observation_id":"6615949d-360f-4b61-aafd-d0fa82c3cc12","resolution":{"observed_at":"2026-08-07T06:01:50.071182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.060206Z","title":"Measuring mathematical problem solving with the MATH dataset","venue":null,"work_id":"2a74a4cd-d0f8-427f-8442-e1e4e770ed82","year":2021},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.578064Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:fd97f41f1a842692371ead9922488b267ae1fb4130cb991ec0d0a54d7b0f5000","observation_id":"a6206ae8-5c3d-49b4-9454-3b9f7b7dfdd7","resolution":{"observed_at":"2026-08-07T06:01:50.063008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.051023Z","title":null,"venue":null,"work_id":"02908e40-9e95-475f-8d1a-497749e11f07","year":2023},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.580921Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:335ad537d54f9fde3d9a80b8a3fcd813f1be7522f2d8edd07565f9d7b9f01d8f","observation_id":"9304a6a1-960c-4815-8029-c7f5c411cc31","resolution":{"observed_at":"2026-08-07T06:01:50.054249Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-07T06:01:49.583947Z","title":"Scaling laws for neural language models.arXiv preprint arXiv:2001.08361, 2020","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.583947Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:f1aabb0500c67ca03f9cfa74a8b9ddfd7ec25051056d05c81713154529ba75fe","observation_id":"58dafe04-cc7a-4e4f-9f17-aac6769e7b41","resolution":{"observed_at":"2026-08-07T06:01:49.583947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.041648Z","title":"Joshi, Hanna Moazam, Heather Miller, Matei Zaharia, and Christopher Potts","venue":null,"work_id":"0c6f90b4-789b-43f1-a4df-858e29c0ab2a","year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.587128Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:ea0f1ec053197c40fa21b6e23e25d7b3eee942dae2a205103619aaa74a5554c8","observation_id":"5d23a060-1f90-47c6-ae2a-39bdaf4805f3","resolution":{"observed_at":"2026-08-07T06:01:50.044666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-07T06:01:49.590032Z","title":"Adam: A method for stochastic optimization.arXiv preprint arXiv:1412.6980, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.590032Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:dbe1d6b15a30f6d3989a2b1acafa12cb12afaece636ee4f3fda6be4988a5e657","observation_id":"ca1cde79-0582-48a3-9987-ef2351bf5337","resolution":{"observed_at":"2026-08-07T06:01:49.590032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.593301Z","title":"Let’s verify step by step","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.593301Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:024fc3a0a34d71aba0144f4348de43995d4f7008970273fb89fde3556db74c22","observation_id":"e2e395fa-293f-4a74-b642-2dc397fdb872","resolution":{"observed_at":"2026-08-07T06:01:49.593301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.04146","last_updated":"2017-10-23T16:45:03Z","snapshot_observed_at":"2026-08-02T16:52:38.363314Z","submitted_at":"2017-05-11T13:04:47Z","title":"Program Induction by Rationale Generation : Learning to Solve and Explain Algebraic Word Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.04146","snapshot_observed_at":"2026-08-07T06:01:49.596287Z","title":"Program induction by rationale generation: Learning to solve and explain algebraic word problems.arXiv preprint arXiv:1705.04146, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.596287Z"},"links":{"cited_paper":"/paper/1705.04146","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:622a645c42e9b34d17414ed7b4211cee07b57b74a00e13d745e93ba9eab58181","observation_id":"c5320723-4884-4098-a925-eb61e99e37b8","resolution":{"observed_at":"2026-08-07T06:01:49.596287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.024496Z","title":"De- ductive verification of chain-of-thought reasoning","venue":null,"work_id":"4df9b319-9ca4-4199-80de-c2fe816e96f8","year":2023},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.599966Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:8c7abac424c0eaaab2f1377edeea7814fdfdda5189c06953742aeb112d7ebaae","observation_id":"894aa066-6ce1-407a-8262-3fd0d77c2a05","resolution":{"observed_at":"2026-08-07T06:01:50.027446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.015518Z","title":"Augmenting math word problems via iter- ative question composing","venue":null,"work_id":"52d9213c-726b-4d03-9d98-1643d7a00c4f","year":2025},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.603100Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:ecec7d58c5f9cb07a79f51c1405e126fb7125339eb6ea4d44413a808e227c645","observation_id":"845cded4-b15d-4a5f-9945-02bb648920de","resolution":{"observed_at":"2026-08-07T06:01:50.018575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09583","last_updated":"2025-06-04T08:58:56Z","snapshot_observed_at":"2026-08-02T06:48:43.121988Z","submitted_at":"2023-08-18T14:23:21Z","title":"WizardMath: Empowering Mathematical Reasoning for Large Language Models via Reinforced Evol-Instruct","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09583","snapshot_observed_at":"2026-08-07T06:01:49.605966Z","title":"Wizardmath: Empowering mathematical reasoning for large language models via reinforced evol-instruct.arXiv preprint arXiv:2308.09583, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.605966Z"},"links":{"cited_paper":"/paper/2308.09583","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:d9dc203b1baad891faa814f84ad6827e5d9f3d336238b03dd93b28693f15a8fb","observation_id":"1d994272-1ae9-4e24-b792-01b45293f264","resolution":{"observed_at":"2026-08-07T06:01:49.605966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:50.006759Z","title":"Self-refine: Iterative refine- ment with self-feedback","venue":null,"work_id":"97c356ff-6d86-49d9-bb29-aa5f0535c490","year":2023},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.609272Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:f117e4b342ba1ae7dcdcd6ed804855cfbb41b76cbe5b5f433fc9aa71ca25ad5f","observation_id":"d391c9a1-d796-49d8-b8f1-4b6dd3343939","resolution":{"observed_at":"2026-08-07T06:01:50.010218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.998189Z","title":"Mixed precision training","venue":null,"work_id":"c6ca3dcc-8856-438a-bee6-e8d1648710f9","year":2018},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.612198Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:2c7782e237653484742dc681bebc01377ccfa91013efe98439c4523b279181c7","observation_id":"0e5fb33f-a412-4300-96f1-554ec0c7cda3","resolution":{"observed_at":"2026-08-07T06:01:50.001032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.990155Z","title":"Language model self-improvement by reinforcement learning contemplation","venue":null,"work_id":"708d23b4-8e4f-452b-b2ce-5911694f8a90","year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.615160Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:62a623fe570fdf7c68c51dc032eb8da2490f75cf72b2a82fb84c0057290c7301","observation_id":"7977b957-b1e6-4d74-80d4-4eac8e9c6d09","resolution":{"observed_at":"2026-08-07T06:01:49.992891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16212","last_updated":"2025-06-16T05:58:00Z","snapshot_observed_at":"2026-08-07T16:48:57.884796Z","submitted_at":"2025-03-20T15:00:41Z","title":"MathFusion: Enhancing Mathematical Problem-solving of LLM through Instruction Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16212","snapshot_observed_at":"2026-08-07T06:01:49.618228Z","title":"Mathfusion: Enhancing mathematic problem-solving of llm through instruction fusion.arXiv preprint arXiv:2503.16212, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.618228Z"},"links":{"cited_paper":"/paper/2503.16212","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:5b02455d631276265f66d7eb21102cdc9bb2d1363481bd5a127497bd25820c05","observation_id":"04767874-cc53-40d4-8f29-3b2332b46b50","resolution":{"observed_at":"2026-08-07T06:01:49.618228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-07T06:01:49.621442Z","title":"Scaling language models: Methods, analysis & insights from training gopher.arXiv preprint arXiv:2112.11446, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.621442Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:f6582c180ed310db1c6f6d6f1cbb2f85fa7632e8c4f2fcf5164893d2f7b41e84","observation_id":"c9fc2a4a-e911-4326-bb45-84ff21f0a476","resolution":{"observed_at":"2026-08-07T06:01:49.621442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.624958Z","title":"Deepspeed: System optimizations enable training deep learning models with over 100 billion parameters","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.624958Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:677919b2d07ec06acb4f4f99ef5ef599f6a1b65ccb6b5d5f98ea5a685f7d8293","observation_id":"cd05c8d1-fc17-4466-a809-6e6af6f526ab","resolution":{"observed_at":"2026-08-07T06:01:49.624958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.627905Z","title":"Analysing mathematical reasoning abilities of neural models","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.627905Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:87023b48b6e7879e49baf0e3495f52790333c9729240a1810745fa63e4fde4ed","observation_id":"22a82896-b587-4f09-8ad6-543654d08c92","resolution":{"observed_at":"2026-08-07T06:01:49.627905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.970424Z","title":"Rewarding progress: Scaling automated process verifiers for LLM reasoning","venue":null,"work_id":"cd4b61eb-026a-41b7-a4b4-348f7945b20c","year":2025},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.630721Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:1de47777a611cc0dd0fc0236be4478e84475af8153f740c713b75a1d5aaeb754","observation_id":"d9ed9ac6-d457-4101-959d-acc064a3f801","resolution":{"observed_at":"2026-08-07T06:01:49.973837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T06:01:49.633553Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open lan- guage models.arXiv preprint arXiv:2402.03300, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.633553Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:22df5807142ee9a5fbdb8cd2e2962ba0ae09a12af6cbf0661f48fbc2297be673","observation_id":"74731a10-536c-431b-bafd-bb46b566c5ea","resolution":{"observed_at":"2026-08-07T06:01:49.633553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.962070Z","title":"Mathscale: Scaling instruction tuning for mathematical reasoning","venue":null,"work_id":"34a38962-71ba-4421-b30b-66714e2d78b2","year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.636577Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:9f973474e5b9dea727fdff0e8c9e76f154b2d2bce7580ba06733a8ce89a28d6b","observation_id":"7b657d8b-325c-4634-a932-9fccc8102c8a","resolution":{"observed_at":"2026-08-07T06:01:49.964749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17565","last_updated":"2025-05-13T07:43:57Z","snapshot_observed_at":"2026-08-07T15:59:30.215146Z","submitted_at":"2025-04-24T13:57:53Z","title":"DeepDistill: Enhancing LLM Reasoning Capabilities via Large-Scale Difficulty-Graded Data Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17565","snapshot_observed_at":"2026-08-07T06:01:49.639408Z","title":"Deepdistill: Enhancing llm reasoning capabilities via large-scale difficulty-graded data training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.639408Z"},"links":{"cited_paper":"/paper/2504.17565","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:ed013b82631c17dc5e2782f8d84775360e5241c8ed9303396d86135c06d717d1","observation_id":"70a24f33-f89f-420e-a912-b3f76ef6311f","resolution":{"observed_at":"2026-08-07T06:01:49.639408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.953886Z","title":"DART-math: Difficulty-aware rejection tuning for mathematical problem-solving","venue":null,"work_id":"6f46233d-66d2-45a5-b646-95679860535b","year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.642734Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:16390443722e154c4f5b13f51b5d9b47335577a9817e4aa5b9a0c000f2bef58a","observation_id":"6f9294c4-bb5f-4959-afeb-825ce813ab14","resolution":{"observed_at":"2026-08-07T06:01:49.956635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.945417Z","title":"Openmathinstruct-2: Accelerating AI for math with massive open-source instruction data","venue":null,"work_id":"642fb79a-8da5-40ae-b6e3-0961b16d5562","year":2025},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.645845Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:400a7f68f3c5b35014caf26ee78294c446861794b0f8aecd7d543f8e0bb54f58","observation_id":"b892089e-e129-442b-83d0-180c10c154bc","resolution":{"observed_at":"2026-08-07T06:01:49.948456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.937143Z","title":"Mathcoder: Seamless code integration in llms for enhanced mathemat- ical reasoning","venue":null,"work_id":"b54af121-bad9-494f-a4f9-80e91ce14ca8","year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.648974Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:aa29acaf5c5a7dc6275ec2783d5b8e511791afc60033f965abfd0db0d22bfc52","observation_id":"45fbdd08-ef36-498b-8511-4bc76f5db7f7","resolution":{"observed_at":"2026-08-07T06:01:49.939948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.652040Z","title":"Math-shepherd: Verify and reinforce llms step-by-step without human annotations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.652040Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:47fb794e368569861a41f1a5ccaf49980f5a33594577365f553149a76fda7f04","observation_id":"933337ac-cda6-4136-ade6-9c7294b793af","resolution":{"observed_at":"2026-08-07T06:01:49.652040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.923250Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":"0ecdae15-f941-4496-86cc-f8ba3f44804f","year":2022},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.655028Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:871a75cae391ff4a486d6911621ddf3f0112ca95ae8bf61e7da1b759c46ddd07","observation_id":"ee371d35-76ef-4986-8abf-a571e1c8f312","resolution":{"observed_at":"2026-08-07T06:01:49.926208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00451","last_updated":"2024-06-17T22:11:49Z","snapshot_observed_at":"2026-07-06T18:08:09.361079Z","submitted_at":"2024-05-01T11:10:24Z","title":"Monte Carlo Tree Search Boosts Reasoning via Iterative Preference Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00451","snapshot_observed_at":"2026-08-07T06:01:49.657996Z","title":"Monte carlo tree search boosts reasoning via iterative preference learning.arXiv preprint arXiv:2405.00451, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.657996Z"},"links":{"cited_paper":"/paper/2405.00451","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:b34b08d0986e7b8228ff2cd167be4af1dd55fb632cc0ac4cbf0959ce12467887","observation_id":"3f1b2dee-12e0-4eea-ac87-090838360a58","resolution":{"observed_at":"2026-08-07T06:01:49.657996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18319","last_updated":"2024-12-31T07:41:30Z","snapshot_observed_at":"2026-08-08T00:04:35.299538Z","submitted_at":"2024-12-24T10:07:51Z","title":"Mulberry: Empowering MLLM with o1-like Reasoning and Reflection via Collective Monte Carlo Tree Search","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18319","snapshot_observed_at":"2026-08-07T06:01:49.661304Z","title":"Mulberry: Empowering mllm with o1-like reasoning and reflection via collective monte carlo tree search.arXiv preprint arXiv:2412.18319, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.661304Z"},"links":{"cited_paper":"/paper/2412.18319","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:cfce7b41514db717015caa538ef30e07782fb5e11d0a764512e0964d381fbc58","observation_id":"eb26364b-9673-4dc3-92d1-342ae56409e4","resolution":{"observed_at":"2026-08-07T06:01:49.661304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02391","last_updated":"2025-05-05T06:26:00Z","snapshot_observed_at":"2026-08-07T15:56:29.149996Z","submitted_at":"2025-05-05T06:26:00Z","title":"Optimizing Chain-of-Thought Reasoners via Gradient Variance Minimization in Rejection Sampling and RL","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.02391","snapshot_observed_at":"2026-08-07T06:01:49.664298Z","title":"Optimizing chain-of-thought reasoners via gradient variance minimization in rejection sampling and rl.arXiv preprint arXiv:2505.02391, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.664298Z"},"links":{"cited_paper":"/paper/2505.02391","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:aafd96a50f14291e45ded5a698aa12f6cf12ae98bd988492b10ae1ded7c74779","observation_id":"bccae710-a182-47cd-93e1-f582b97def4c","resolution":{"observed_at":"2026-08-07T06:01:49.664298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.667556Z","title":"Griffiths, Yuan Cao, and Karthik R Narasimhan","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.667556Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:5712e0017e9344e2eda3b668c4b12bb4e6bdfc7cade73be69d040406f139ab80","observation_id":"7f6473ac-46ea-47f6-b125-57b7ea2d72c0","resolution":{"observed_at":"2026-08-07T06:01:49.667556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.670751Z","title":"Metamath: Bootstrap your own mathematical questions for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.670751Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:7ba12e8e7c659c4c9861bbaad17f5cee9bd3f30a45e3db5bf66ae9684e22f606","observation_id":"3f1b7163-dc08-4270-b641-0658e9727f5e","resolution":{"observed_at":"2026-08-07T06:01:49.670751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01825","last_updated":"2023-09-13T03:57:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-03T15:34:01Z","title":"Scaling Relationship on Learning Mathematical Reasoning with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01825","snapshot_observed_at":"2026-08-07T06:01:49.674191Z","title":"Scaling relationship on learning mathematical reasoning with large language models.arXiv preprint arXiv:2308.01825, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.674191Z"},"links":{"cited_paper":"/paper/2308.01825","citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:d9233e8bbe33226867a4020d9f858f2013b8d60695cf2637f7fadfe7612ad84b","observation_id":"d6c23084-484b-49cc-9614-de44279b59ca","resolution":{"observed_at":"2026-08-07T06:01:49.674191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.904200Z","title":"Optimizing generative ai by backpropagating language model feedback.Nature, 639:609– 616, 2025","venue":null,"work_id":"aba6eee5-d22b-4293-bc83-a22693ab397f","year":2025},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.677863Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:cd3562d19329c26f4a8a0b3e8b50c5eaf12576c4ecbe5539906a49f735cbe85d","observation_id":"eff1e131-cff3-42a4-a439-64d4d7de1691","resolution":{"observed_at":"2026-08-07T06:01:49.907121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.680835Z","title":"Rest-mcts*: Llm self-training via process reward guided tree search.Advances in Neural Information Processing Systems, 37:64735–64772, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.680835Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:1d32e85c9c6be9ac4240ab3fb3c81ac26aa4d4480a487fc8876c4a43f27bcf55","observation_id":"f8934e60-64aa-458e-b0d6-d235526a419b","resolution":{"observed_at":"2026-08-07T06:01:49.680835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.889337Z","title":"Generative verifiers: Reward modeling as next-token prediction","venue":null,"work_id":"f1ad7114-9a52-4d93-b469-3f5704ba2228","year":2025},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.684016Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:280881074849953f4d422a19a2b9e0e1514ffcc32cbc2092ba3b661f2920bde6","observation_id":"1f45e870-0fa1-4943-972e-ba6306902764","resolution":{"observed_at":"2026-08-07T06:01:49.892757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.879918Z","title":"Chain of preference optimization: Improving chain-of-thought reasoning in LLMs","venue":null,"work_id":"0a5a2a2f-c95d-468e-afcb-13cfaf53927d","year":2024},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.687276Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:36d2118228d361fb0c93488915de6a56e24b7b14370505c0d09e3a0e97e1e685","observation_id":"a4b74b54-490a-4d21-a8ad-362f80aeaa36","resolution":{"observed_at":"2026-08-07T06:01:49.882850Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.871234Z","title":"The computation sequence token length was fixed at 4096 to capture long range mathematical rea- soning","venue":null,"work_id":"4dbf027d-1310-4232-a34c-7b5e95adedfe","year":null},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.690658Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:b90e102bfcf1cd4eb4e173375d669bcd1143743af497e9bb35e56805411310ff","observation_id":"80bb1ffd-0e50-4f9d-93f3-70b224317ae2","resolution":{"observed_at":"2026-08-07T06:01:49.874125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:01:49.860476Z","title":"Step 2:Use the given altitude length to solve forx","venue":null,"work_id":"d82a8d95-c56a-4921-ad95-2f19165b5616","year":null},"citing_paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T06:01:49.694046Z"},"links":{"citing_paper":"/paper/2506.06470"},"observation_digest":"sha256:66dbd58a336274b14bac45ee4aa5a5e1890ec457544dc53196d5ecf4ac64af76","observation_id":"2316e3fe-bec0-481d-90b0-f1d776bdce3a","resolution":{"observed_at":"2026-08-07T06:01:49.864918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.06470","last_updated":"2025-06-06T18:55:16Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T05:53:54.045201Z","submitted_at":"2025-06-06T18:55:16Z","title":"SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":0,"verified_fuzzy":24},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 1 inbound Pith citation observation for arXiv:2506.06470."}