{"as_of":"2026-08-18T14:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0698557cd37947ed42ac63ce7097f24117de6f7e780de2a2e8f6329485aa149a","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T10:38:28.303524Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.17665/citation-record","integrity":"/paper/2504.17665/integrity","json":"/paper/2504.17665/citation-record.json","paper":"/paper/2504.17665"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:27.159490Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.159490Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:59242bf53427b746d3bc3a7a96140a489a015286d928067fe6bd674b7d23d56c","observation_id":"62a960ec-5e32-450a-96d9-08c7fe067a1a","resolution":{"observed_at":"2026-08-16T10:38:27.159490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:27.256611Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.256611Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:8156236eb355ef54c95b1f16b13a09e785a4fe8295081d1343e8232a6fb42159","observation_id":"506503f3-8331-40a1-9a64-ba58128b6830","resolution":{"observed_at":"2026-08-16T10:38:27.256611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-16T10:38:27.277342Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.277342Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:ba38ff8e711c1db71e3a9ebbc57248661478dfb063b019f6ffcf6bca50b671d8","observation_id":"e79519a5-0baa-460e-a67d-5feeff3aba02","resolution":{"observed_at":"2026-08-16T10:38:27.277342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-16T10:38:27.285575Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.285575Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:5a7c6c5cd0bdeb97ecdbf26a10ddacfb36df836a79c4f023c85443d4eeb74102","observation_id":"ff58524e-b33a-4208-8c31-6305b3699408","resolution":{"observed_at":"2026-08-16T10:38:27.285575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12588","last_updated":"2023-10-23T01:27:38Z","snapshot_observed_at":"2026-08-02T13:06:11.850456Z","submitted_at":"2022-11-22T21:06:00Z","title":"Program of Thoughts Prompting: Disentangling Computation from Reasoning for Numerical Reasoning Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.12588","snapshot_observed_at":"2026-08-16T10:38:27.305525Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.305525Z"},"links":{"cited_paper":"/paper/2211.12588","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:c5f22d0fbe1e6e87a8c0b3b4b3b9292926a4a63bb0012441d9c6f12e5ac35759","observation_id":"dada4289-5d98-4b00-82b1-e2e86c9b2d3f","resolution":{"observed_at":"2026-08-16T10:38:27.305525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:28.907004Z","title":null,"venue":null,"work_id":"b2a8207a-78c5-49d3-bf28-84a9eb9ca898","year":2025},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.408830Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:dfae046adb0c5ba108fd13ed6192018f94db12fb116599d78e55d4480c7099cf","observation_id":"2f794079-b4e6-4394-8ddf-6b4cdcceb854","resolution":{"observed_at":"2026-08-16T10:38:28.911559Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-16T10:38:27.435610Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.435610Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:71f5bf58d1047fdaa769cd83d67f14b1b68fa17f7521068d8f8db96006c17a9f","observation_id":"2d75e65c-7674-4401-aa0b-92df0c40e0f7","resolution":{"observed_at":"2026-08-16T10:38:27.435610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17231","last_updated":"2024-04-03T15:22:35Z","snapshot_observed_at":"2026-08-16T14:15:02.628360Z","submitted_at":"2024-02-27T05:50:35Z","title":"MATHSENSEI: A Tool-Augmented Large Language Model for Mathematical Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17231","snapshot_observed_at":"2026-08-16T10:38:27.447288Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.447288Z"},"links":{"cited_paper":"/paper/2402.17231","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:397f1fdef9b57918a743fb6be001b34cf16fe3668a7d49914d2b527520ff9701","observation_id":"32c92f81-8e5f-4c35-b37f-9c1392d60637","resolution":{"observed_at":"2026-08-16T10:38:27.447288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:27.534750Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.534750Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:7010f19c04bb6636aa33f231eb39c99b15ce3cbb931dd9deebdc9866e9aaf027","observation_id":"4f422dc0-0654-44d6-bdbc-bda1a0d83758","resolution":{"observed_at":"2026-08-16T10:38:27.534750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-16T10:38:27.580437Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.580437Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:8372d535656a8630195a42d210722c405a1db0964279d1b61d5caeadf772aac9","observation_id":"8749a97e-aa6b-4800-bce8-8b7d742c5859","resolution":{"observed_at":"2026-08-16T10:38:27.580437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:28.701912Z","title":null,"venue":null,"work_id":"61782560-9d5e-436b-867c-ab3e9b6fa5fc","year":2022},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.678437Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:0cf4500722b4688edbcd1527983215c5a1f980de2bf639c5ae8981528987540b","observation_id":"7b4b1caf-91ca-4e0c-bb3d-20effa818813","resolution":{"observed_at":"2026-08-16T10:38:28.842314Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:27.705902Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.705902Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:63b2ad99d06277a2f14068fe85587f9126ed98494f395c4fd94aeed56cddf8e3","observation_id":"1d544743-a921-459d-993d-eb76b5a5ada0","resolution":{"observed_at":"2026-08-16T10:38:27.705902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.07919","last_updated":"2023-09-12T15:08:46Z","snapshot_observed_at":"2026-08-16T16:08:23.354691Z","submitted_at":"2022-12-15T15:52:39Z","title":"ROSCOE: A Suite of Metrics for Scoring Step-by-Step Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.07919","snapshot_observed_at":"2026-08-16T10:38:27.721732Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.721732Z"},"links":{"cited_paper":"/paper/2212.07919","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:2c39215d594382c6c07963f308e99ee0fd0466395c19c401cd98d08c653e457a","observation_id":"da02a7ba-5c01-4ac7-af52-ff898ee082b6","resolution":{"observed_at":"2026-08-16T10:38:27.721732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17452","last_updated":"2024-02-21T12:59:22Z","snapshot_observed_at":"2026-08-15T05:04:59.720326Z","submitted_at":"2023-09-29T17:59:38Z","title":"ToRA: A Tool-Integrated Reasoning Agent for Mathematical Problem Solving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17452","snapshot_observed_at":"2026-08-16T10:38:27.731733Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.731733Z"},"links":{"cited_paper":"/paper/2309.17452","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:e39abfb7007b9c8858aa885a0456b2d6db3345a2ca0efa71bc5215bf41be9d39","observation_id":"7b7701e4-daa6-4806-b3cb-94f779d066c7","resolution":{"observed_at":"2026-08-16T10:38:27.731733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05221","last_updated":"2024-08-11T22:20:19Z","snapshot_observed_at":"2026-08-16T14:02:52.207183Z","submitted_at":"2024-04-08T06:35:09Z","title":"LLM Reasoners: New Evaluation, Library, and Analysis of Step-by-Step Reasoning with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05221","snapshot_observed_at":"2026-08-16T10:38:27.817668Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.817668Z"},"links":{"cited_paper":"/paper/2404.05221","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:8b552f958b2eda14739e8042830e8608121b698f6b38aa2db0e2c62a9b18472f","observation_id":"83f28c52-37e4-42fd-abdb-b02d042ec52e","resolution":{"observed_at":"2026-08-16T10:38:27.817668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-16T10:38:27.856738Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.856738Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:af29a3a19c74eb9eb0b29b4740060b9a65738dd917489d6afc7460357497095a","observation_id":"a1e98042-fb50-45d1-aea0-72ac99a2a6e1","resolution":{"observed_at":"2026-08-16T10:38:27.856738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05398","last_updated":"2023-03-04T04:43:49Z","snapshot_observed_at":"2026-08-16T15:50:52.123484Z","submitted_at":"2023-03-04T04:43:49Z","title":"MathPrompter: Mathematical Reasoning using Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05398","snapshot_observed_at":"2026-08-16T10:38:27.861159Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.861159Z"},"links":{"cited_paper":"/paper/2303.05398","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:9f66d8a3446033e04043cb9860790e02cd07ad0d3050b7d97e5eb7d00ce3d01b","observation_id":"7fbaa48e-c3f8-409b-b597-87b03c0d2784","resolution":{"observed_at":"2026-08-16T10:38:27.861159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11863","last_updated":"2024-04-01T08:33:11Z","snapshot_observed_at":"2026-08-16T16:56:34.956611Z","submitted_at":"2024-02-19T06:11:28Z","title":"How Interpretable are Reasoning Explanations from Prompting Large Language Models?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11863","snapshot_observed_at":"2026-08-16T10:38:27.876660Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.876660Z"},"links":{"cited_paper":"/paper/2402.11863","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:692bfb21fed412c99b4696663523811732dbcd1ce46a2ee92c9936411c646fe8","observation_id":"8d49385a-1479-481a-a344-7af00853427a","resolution":{"observed_at":"2026-08-16T10:38:27.876660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:27.884720Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.884720Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:c5c1adf13e2db2fd4698d13a55cd6d31d8064d2f86175f80a8b342937ea2785e","observation_id":"ac83fd1c-703b-4bb0-af44-4e9f7c456e1b","resolution":{"observed_at":"2026-08-16T10:38:27.884720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00755","last_updated":"2024-06-02T14:16:24Z","snapshot_observed_at":"2026-08-17T04:07:36.271566Z","submitted_at":"2024-06-02T14:16:24Z","title":"Evaluating Mathematical Reasoning of Large Language Models: A Focus on Error Identification and Correction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00755","snapshot_observed_at":"2026-08-16T10:38:27.976338Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:27.976338Z"},"links":{"cited_paper":"/paper/2406.00755","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:7291fcb89a81e1b79dda3e9b39980099cc59848d8e35e9ef50cdfc1dd56051bd","observation_id":"1b945a6d-a71f-40d9-a7c0-fc80f0ffb998","resolution":{"observed_at":"2026-08-16T10:38:27.976338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-17T09:42:34.746112Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-16T10:38:28.008119Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.008119Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:b7e44dd01c44343234ec7f84aa0e8da124a9575f0b01bd75b755f1fed327a54e","observation_id":"fdf7c8da-a15a-4dfa-8579-c6ceee6a6bf8","resolution":{"observed_at":"2026-08-16T10:38:28.008119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:28.012469Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.012469Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:90d4eb9f4edd76cca6d6282d15f1282bcd507799995765a778ce9877ea629a35","observation_id":"a5df8063-c254-4073-ad11-dbe39036e38c","resolution":{"observed_at":"2026-08-16T10:38:28.012469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19173","last_updated":"2024-02-29T13:53:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-29T13:53:35Z","title":"StarCoder 2 and The Stack v2: The Next Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19173","snapshot_observed_at":"2026-08-16T10:38:28.017095Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.017095Z"},"links":{"cited_paper":"/paper/2402.19173","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:c825735a2e1d85d700daf8f1a55dc0358bd066def27dc8f8d2caf82eee342add","observation_id":"db3513a4-b966-44bd-af55-159ec022d21b","resolution":{"observed_at":"2026-08-16T10:38:28.017095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13379","last_updated":"2023-09-20T22:19:30Z","snapshot_observed_at":"2026-08-16T15:58:58.468142Z","submitted_at":"2023-01-31T03:04:26Z","title":"Faithful Chain-of-Thought Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13379","snapshot_observed_at":"2026-08-16T10:38:28.021493Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.021493Z"},"links":{"cited_paper":"/paper/2301.13379","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:30c9e46f8ba76d0d38f79a9b1c08b080153ce19b262eac76daf5bf6e20892212","observation_id":"4cf74b68-30c9-40b6-8623-6fd74e7b2993","resolution":{"observed_at":"2026-08-16T10:38:28.021493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:28.025866Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.025866Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:ac7bb4275336b44c0f6e7135ddd4e76cce78f488e057520b8dcf5ef6b3247f84","observation_id":"9ef4e6f1-ae80-4668-b1f4-36bf68506952","resolution":{"observed_at":"2026-08-16T10:38:28.025866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:28.069599Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.069599Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:ec5708998466b490ce35742513fe9558ce6a467418ade318a1fa34d2099968a5","observation_id":"8453e4c9-49b1-47bb-8ecc-f7b35f7bbb24","resolution":{"observed_at":"2026-08-16T10:38:28.069599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-16T10:38:28.135870Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.135870Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:65eb6cefd59ddace14ec8a83711b8b710426553c560b98faf15830b1c633bb7a","observation_id":"1e4e2223-d431-4ae9-9af0-a9e31ef49758","resolution":{"observed_at":"2026-08-16T10:38:28.135870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.10297","last_updated":"2020-09-27T04:07:11Z","snapshot_observed_at":"2026-08-12T14:26:33.940158Z","submitted_at":"2020-09-22T03:10:49Z","title":"CodeBLEU: a Method for Automatic Evaluation of Code Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.10297","snapshot_observed_at":"2026-08-16T10:38:28.140228Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.140228Z"},"links":{"cited_paper":"/paper/2009.10297","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:c667655c745d13753d7b23f3a1e1cb99673830c6da679801f7b4c59b3ae95e1d","observation_id":"10a79d37-2910-49f3-aff6-d11fd8c59d4c","resolution":{"observed_at":"2026-08-16T10:38:28.140228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-08-18T03:59:39.242039Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-16T10:38:28.144373Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.144373Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:037e28f79b054d25743f466fda04ae77d7cb9f7868ed428f4843706d7d79a806","observation_id":"63a95e6a-6204-4928-98c8-5864781550c9","resolution":{"observed_at":"2026-08-16T10:38:28.144373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:28.148351Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.148351Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:8b0a27ec28025aa2f27856c93c62619334b0ac6e60cb5d1fe3faf08bfd6af785","observation_id":"280b389d-db6e-44e7-bb5d-e48cbf25c1b3","resolution":{"observed_at":"2026-08-16T10:38:28.148351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:28.661124Z","title":"https://lyz-code.github.io/autoimport/ autoimport","venue":null,"work_id":"8412bdea-ab58-44bd-b677-db4e7bc6a51d","year":null},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.151866Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:2c908c24df59cbec09753769ae2db3dcf8759e96f236cc5766491d4c3a974200","observation_id":"870b4498-931c-41cd-a6e7-abbc8839b71d","resolution":{"observed_at":"2026-08-16T10:38:28.666950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:28.157210Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.157210Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:c0743f9d0451ca9aab369a124f537cf621563f4b2bfa1465b5740b15fad964a7","observation_id":"444747c2-aba4-48de-b594-2650b1891a9a","resolution":{"observed_at":"2026-08-16T10:38:28.157210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:38:28.161671Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.161671Z"},"links":{"citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:760123923b85bb89b21be0e31eee3be8ce8d06b2097dead8d3bcb091e00ee850","observation_id":"0572d174-3895-4ae9-b9ed-00e10be25196","resolution":{"observed_at":"2026-08-16T10:38:28.161671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.05653","last_updated":"2023-10-03T02:48:42Z","snapshot_observed_at":"2026-08-18T06:58:51.738907Z","submitted_at":"2023-09-11T17:47:22Z","title":"MAmmoTH: Building Math Generalist Models through Hybrid Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.05653","snapshot_observed_at":"2026-08-16T10:38:28.165082Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.165082Z"},"links":{"cited_paper":"/paper/2309.05653","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:fcd804f3929d21f8a68520ce62b03e3de72ecf93be5377df337a87f7413d8277","observation_id":"37de6bae-2ec7-4da3-805b-3b2633deb28f","resolution":{"observed_at":"2026-08-16T10:38:28.165082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07921","last_updated":"2023-08-15T17:58:45Z","snapshot_observed_at":"2026-08-18T00:34:56.310356Z","submitted_at":"2023-08-15T17:58:45Z","title":"Solving Challenging Math Word Problems Using GPT-4 Code Interpreter with Code-based Self-Verification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07921","snapshot_observed_at":"2026-08-16T10:38:28.255976Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.255976Z"},"links":{"cited_paper":"/paper/2308.07921","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:e018b614d117ca575e9898f9fa6f35d41c768f8e53113ae3e94f839d4e4fc2a5","observation_id":"386764f5-7076-40d2-9519-fa12012ec13d","resolution":{"observed_at":"2026-08-16T10:38:28.255976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05527","last_updated":"2023-10-31T13:44:36Z","snapshot_observed_at":"2026-08-17T12:44:10.727209Z","submitted_at":"2023-02-10T22:12:05Z","title":"CodeBERTScore: Evaluating Code Generation with Pretrained Models of Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05527","snapshot_observed_at":"2026-08-16T10:38:28.303524Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-16T10:38:28.303524Z"},"links":{"cited_paper":"/paper/2302.05527","citing_paper":"/paper/2504.17665"},"observation_digest":"sha256:b9fe477de0ae156f83c45b3a35512989e7dc99fee5575caf9697e7699b1f523e","observation_id":"a7e1db0b-a0d7-4091-b74b-704b71752da3","resolution":{"observed_at":"2026-08-16T10:38:28.303524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.17665","last_updated":"2025-07-22T11:52:51Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-18T12:27:09.844253Z","submitted_at":"2025-04-24T15:34:24Z","title":"Evaluating Intermediate Reasoning of Code-Assisted Large Language Models for Mathematics"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2504.17665."}