{"as_of":"2026-08-08T09:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9c6de995352f7e4ad47a1bd5ccafc12f06384b3de1423569b8e2277d6b681fcd","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:33:40.054182Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.14852/citation-record","integrity":"/paper/2505.14852/integrity","json":"/paper/2505.14852/citation-record.json","paper":"/paper/2505.14852"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:43.010471Z","title":null,"venue":null,"work_id":"3ee0b306-8fc4-4e4a-87dc-3cedddb5554c","year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:34.469868Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:045df983fe8eeca21b543cc1e6350f3b555102a948f2edc08821adbf91dfdfcd","observation_id":"90faacad-de6a-4a6e-894a-f6e2422b6dda","resolution":{"observed_at":"2026-08-07T15:33:43.092798Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02737","last_updated":"2025-02-04T21:43:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-04T21:43:16Z","title":"SmolLM2: When Smol Goes Big -- Data-Centric Training of a Small Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02737","snapshot_observed_at":"2026-08-07T15:33:34.591326Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:34.591326Z"},"links":{"cited_paper":"/paper/2502.02737","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:1616497fb01c5757770056ac1ade42ef7534bfa3b0d551d4f3245273d4274f1e","observation_id":"a565356e-2b37-4f57-8bcb-f657075dca0a","resolution":{"observed_at":"2026-08-07T15:33:34.591326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08347","last_updated":"2024-12-11T12:41:36Z","snapshot_observed_at":"2026-07-06T20:05:14.412418Z","submitted_at":"2024-12-11T12:41:36Z","title":"SmolTulu: Higher Learning Rate to Batch Size Ratios Can Lead to Better Reasoning in SLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08347","snapshot_observed_at":"2026-08-07T15:33:34.734735Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:34.734735Z"},"links":{"cited_paper":"/paper/2412.08347","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:8fb9cabef5c03cf9ba1481013c023d42a912880f9da4275e372d1aacf7c5164c","observation_id":"d377918b-737e-48d9-8599-931c22b54de2","resolution":{"observed_at":"2026-08-07T15:33:34.734735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:34.839055Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:34.839055Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:94076feecbc57b59f1d08a4468f188060883f3810f5281482a9d928ebae3fe38","observation_id":"76b9f612-9f93-44f5-97f4-69ee24fba3dc","resolution":{"observed_at":"2026-08-07T15:33:34.839055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01373","last_updated":"2023-05-31T17:54:07Z","snapshot_observed_at":"2026-08-07T23:49:29.478548Z","submitted_at":"2023-04-03T20:58:15Z","title":"Pythia: A Suite for Analyzing Large Language Models Across Training and Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.01373","snapshot_observed_at":"2026-08-07T15:33:34.990367Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:34.990367Z"},"links":{"cited_paper":"/paper/2304.01373","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:ab7a9fe5eb9bd4108a4f18e12eea9d988192a9e795291f3938fa644c601fdeea","observation_id":"ffe08e67-6ea9-4548-81e5-1c48b9f14946","resolution":{"observed_at":"2026-08-07T15:33:34.990367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:35.139266Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:35.139266Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:d28155a03579a7c25e2af8dfbad3cae026f1550cd62011415847df07f86920bb","observation_id":"ba7054e5-3cb9-487b-aa64-500e8541786b","resolution":{"observed_at":"2026-08-07T15:33:35.139266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T15:33:35.241541Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:35.241541Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:2945f4107c17b7e1d121c0de441fe5fc84ef3ac37228470ae115205a0b3d2221","observation_id":"33ec6601-6d10-430c-b848-8b1abfe03db9","resolution":{"observed_at":"2026-08-07T15:33:35.241541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T15:33:35.354510Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:35.354510Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:285023c48599885a2504321668c527ab7680711cb52e36184935dce5ed734f9f","observation_id":"6f364498-8928-4be2-9e6c-ded476879f25","resolution":{"observed_at":"2026-08-07T15:33:35.354510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T15:33:35.492369Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:35.492369Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:58a5730dadf379536ac3d207401a50bbf4a30b17a67975204fab20e5646504a6","observation_id":"0dad5c8c-6391-402e-8b5f-0d2d5a6f3764","resolution":{"observed_at":"2026-08-07T15:33:35.492369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:35.632260Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:35.632260Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:f4c5cd3df3cb1da4d79a0a744045e4423d388d5e4a87bc84f9c62d61f954ca99","observation_id":"7f9d406d-0364-4881-b5c0-449430461f92","resolution":{"observed_at":"2026-08-07T15:33:35.632260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:42.783775Z","title":null,"venue":null,"work_id":"ee79f9a7-9a09-491c-8f87-99f82c11ccee","year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:35.749721Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:301068e5ae6c4b08b3622fc17c717f7c606d406fe4453ce7a66e589da73e8f5e","observation_id":"0646abf8-6c3b-455d-9d75-48f7e4a3ec00","resolution":{"observed_at":"2026-08-07T15:33:42.891359Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07647","last_updated":"2024-04-11T11:10:36Z","snapshot_observed_at":"2026-07-06T17:58:47.786948Z","submitted_at":"2024-04-11T11:10:36Z","title":"Why do small language models underperform? Studying Language Model Saturation via the Softmax Bottleneck","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07647","snapshot_observed_at":"2026-08-07T15:33:35.873061Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:35.873061Z"},"links":{"cited_paper":"/paper/2404.07647","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:6439010b9d3ffeb891df1b67e7a4c0b07018a36f10cdbd7f32d131bbc9bf737d","observation_id":"52cbf95b-fe71-4410-93b3-355dcd598466","resolution":{"observed_at":"2026-08-07T15:33:35.873061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-07T15:33:36.629741Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:36.629741Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:692b22f1198495fa1645b45d5c8e6774b463e0299e14d23c6f337dfa9c80acf0","observation_id":"875eb6c7-77d2-4f50-ae3e-adc6258a03ab","resolution":{"observed_at":"2026-08-07T15:33:36.629741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-07T15:33:37.175443Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:37.175443Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:cda3a9984c71f8ed1725c1f47b6f3f7dc62b2271e9d708c416e2682494d91d30","observation_id":"10b92260-0f6c-4c7f-8ce7-88f20971cff0","resolution":{"observed_at":"2026-08-07T15:33:37.175443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12393","last_updated":"2024-09-19T01:34:43Z","snapshot_observed_at":"2026-08-06T18:37:15.578000Z","submitted_at":"2024-09-19T01:34:43Z","title":"Small Language Models are Equation Reasoners","version":1},"cited_work":{"arxiv_id":"2409.12393","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.12393","snapshot_observed_at":"2026-08-07T15:33:40.556734Z","title":"Small Language Models are Equation Reasoners","venue":"cs.CL","work_id":"dc625f54-696a-465c-8ce4-f89b677bfff9","year":2024},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:37.277665Z"},"links":{"cited_paper":"/paper/2409.12393","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:daf22ee7d61a3c41fe699ce76692c8d8500d3536e07547d02d95fdb934ff5b46","observation_id":"516bf4ce-a250-4a5d-94c7-97455811903a","resolution":{"observed_at":"2026-08-07T15:33:40.659636Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11916","last_updated":"2023-01-29T05:14:17Z","snapshot_observed_at":"2026-08-07T04:02:08.445660Z","submitted_at":"2022-05-24T09:22:26Z","title":"Large Language Models are Zero-Shot Reasoners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11916","snapshot_observed_at":"2026-08-07T15:33:37.378908Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:37.378908Z"},"links":{"cited_paper":"/paper/2205.11916","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:506a3eaf74fd701953cc01c9c9619d132ea18e5feb0e917e4c09ea525d8c8c29","observation_id":"d5d1d6f8-432b-406d-94d9-91678f5f5330","resolution":{"observed_at":"2026-08-07T15:33:37.378908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:37.486978Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:37.486978Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:6c184d00f1edd839a1d267c224c567dc35bdd2624d0322809899931844351b16","observation_id":"33cbc24f-b11d-4147-9293-9bdef445c17f","resolution":{"observed_at":"2026-08-07T15:33:37.486978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-05T13:11:04.104454Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-07T15:33:37.553937Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:37.553937Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:b7947ad45f72750c9f9e4bf02d785dc61d9526bea7b09573b70bbbc8d11e74bf","observation_id":"8c4ccdee-c447-4b73-8fb8-1de0f632c685","resolution":{"observed_at":"2026-08-07T15:33:37.553937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15084","last_updated":"2025-01-17T07:12:55Z","snapshot_observed_at":"2026-07-06T20:10:19.704368Z","submitted_at":"2024-12-19T17:29:44Z","title":"AceMath: Advancing Frontier Math Reasoning with Post-Training and Reward Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15084","snapshot_observed_at":"2026-08-07T15:33:37.634222Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:37.634222Z"},"links":{"cited_paper":"/paper/2412.15084","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:7f35b92cdc36af001303fd4b8518e2707db75ccd58ec1e87f01b128f95e747fe","observation_id":"a15bbb19-5bf1-4a84-b846-63bc33d71447","resolution":{"observed_at":"2026-08-07T15:33:37.634222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:42.493404Z","title":"Tang, Manan Roongta, Colin Cai, Jeffrey Luo, Tianjun Zhang, Li Erran Li, Raluca Ada Popa, and Ion Stoica","venue":null,"work_id":"42fb4840-8cfa-4d3b-9e2f-090fbe338e37","year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:37.735513Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:68f0cc4af847176fa9a095ae5ce1ce57cac3a44f2c8641203f553a31750a45a0","observation_id":"ed68e050-b62c-457e-99f4-10131f0d9a72","resolution":{"observed_at":"2026-08-07T15:33:42.614619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:37.871657Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:37.871657Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:2bf16d9c5c0c33cae70819082b377ed3ce9fafaacd53d73e4768b633d3ff767c","observation_id":"947b9b6e-5d77-4502-adac-160122208733","resolution":{"observed_at":"2026-08-07T15:33:37.871657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:37.983486Z","title":"Smith, Mateusz Paprocki, Ond r ej C ert\\' i k, Sergey B","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:37.983486Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:f6c48dae64819148b13ffe31142f44836c6d5f5e4f9bff33d1f033c05f2dfe60","observation_id":"ed060ce2-7340-4389-a9c0-ca72d51e99fd","resolution":{"observed_at":"2026-08-07T15:33:37.983486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05229","last_updated":"2025-08-27T16:24:39Z","snapshot_observed_at":"2026-07-06T19:29:09.714725Z","submitted_at":"2024-10-07T17:36:37Z","title":"GSM-Symbolic: Understanding the Limitations of Mathematical Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05229","snapshot_observed_at":"2026-08-07T15:33:38.090090Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:38.090090Z"},"links":{"cited_paper":"/paper/2410.05229","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:e368713928e11aaef830ad68c6b64eb0351c1b4ae4df7be900b26d81b7f3dfd9","observation_id":"7640b833-2cea-4df8-9c5c-22f5d204ca49","resolution":{"observed_at":"2026-08-07T15:33:38.090090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14830","last_updated":"2024-02-16T23:44:38Z","snapshot_observed_at":"2026-08-01T01:16:04.260529Z","submitted_at":"2024-02-16T23:44:38Z","title":"Orca-Math: Unlocking the potential of SLMs in Grade School Math","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14830","snapshot_observed_at":"2026-08-07T15:33:38.212486Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:38.212486Z"},"links":{"cited_paper":"/paper/2402.14830","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:469d20a21cc32aae738e9ba9e901eb693323e049bba465a0818ed16866883ca6","observation_id":"5957711c-016b-44aa-9c2f-4b9be5d64618","resolution":{"observed_at":"2026-08-07T15:33:38.212486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T15:33:38.344953Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:38.344953Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:921e8fd13576eafd055384fa1b06f0af24a9e0a041e4d4a5c62eac3dd0c71038","observation_id":"148b9d02-ea88-4b10-8076-0ba90c616ba9","resolution":{"observed_at":"2026-08-07T15:33:38.344953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:42.179717Z","title":null,"venue":null,"work_id":"f00c4f5f-6f48-4083-bdd7-8c2d36254feb","year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:38.478698Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:d6d8efe4e5954df337ef49dfdead37b2c71b4ca14ca43c6f2d7719049e1471d2","observation_id":"6c6a137b-c7aa-40a3-9a95-492e6ecddc02","resolution":{"observed_at":"2026-08-07T15:33:42.345896Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06608","last_updated":"2025-02-26T18:59:01Z","snapshot_observed_at":"2026-07-06T18:28:24.821865Z","submitted_at":"2024-06-06T18:10:11Z","title":"The Prompt Report: A Systematic Survey of Prompt Engineering Techniques","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06608","snapshot_observed_at":"2026-08-07T15:33:38.633083Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:38.633083Z"},"links":{"cited_paper":"/paper/2406.06608","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:f68b19e4b811f971258e3d61311078a0329924dff41464eaca60be8de1afe954","observation_id":"7a141da2-b4ab-48e2-a8a7-7026c7fcb4f5","resolution":{"observed_at":"2026-08-07T15:33:38.633083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:38.769960Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:38.769960Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:bf77d69b55b29921eb98c4471762026567cf3ffa3a5c27d0e789d21a0d52d98d","observation_id":"986be034-7e93-4ade-b3ba-aad732d171cd","resolution":{"observed_at":"2026-08-07T15:33:38.769960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:41.846971Z","title":null,"venue":null,"work_id":"a83f8aa6-fc7b-454d-80f0-462860927f73","year":2024},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:38.892189Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:4bf9b45c18322c492c31c17151fbe8391b27e69474a0ef4beeaa62245cf8307c","observation_id":"a2178cdb-e543-4f74-81af-9014fa6d2633","resolution":{"observed_at":"2026-08-07T15:33:41.999157Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16974","last_updated":"2025-09-13T01:57:49Z","snapshot_observed_at":"2026-08-07T16:47:06.262521Z","submitted_at":"2025-03-21T09:43:37Z","title":"Assessing Consistency and Reproducibility in the Outputs of Large Language Models: Evidence Across Diverse Finance and Accounting Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16974","snapshot_observed_at":"2026-08-07T15:33:39.064313Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:39.064313Z"},"links":{"cited_paper":"/paper/2503.16974","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:ab6b646626e7a2fde024383a85d170d8d1dafdec8b65abd8f05dc8272568cd19","observation_id":"afce4c83-1dbc-448d-82ba-b27682fe53ec","resolution":{"observed_at":"2026-08-07T15:33:39.064313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-07T15:33:39.197297Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:39.197297Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:aa921e3a0d5b7fc3249e00b8295bf7431f9bd3ec2672d931c38778ca9a48c3a2","observation_id":"d242bde7-67b3-4d7e-8b7f-815bb20c405d","resolution":{"observed_at":"2026-08-07T15:33:39.197297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:41.534861Z","title":null,"venue":null,"work_id":"64d9f8b9-abac-4cd8-a9a3-93d7a3e371c8","year":2022},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:39.309003Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:9c21e4bd10e43a0fc969d52dfaa7937eb78f13baf83d0a975dea9daded40385a","observation_id":"dda988bc-f105-41ad-b6d0-14106b9868a1","resolution":{"observed_at":"2026-08-07T15:33:41.710632Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-07T15:33:39.413606Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:39.413606Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:22e4c51bc312590dfdf4a228d4b7d79c109f1feac9eecf63c6fc0997f664520e","observation_id":"3ad32bed-7a73-4912-b2b7-842e074ad359","resolution":{"observed_at":"2026-08-07T15:33:39.413606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17974","last_updated":"2025-01-31T16:06:26Z","snapshot_observed_at":"2026-07-06T20:28:09.807683Z","submitted_at":"2025-01-29T20:20:48Z","title":"Think Smarter not Harder: Adaptive Reasoning with Inference Aware Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17974","snapshot_observed_at":"2026-08-07T15:33:39.589453Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:39.589453Z"},"links":{"cited_paper":"/paper/2501.17974","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:9a01f58a28120eddd855f55a3ff8cc1128b618cb7a884d07a12a4f065a672810","observation_id":"a7819084-3c02-4d22-af5d-ad91db41beab","resolution":{"observed_at":"2026-08-07T15:33:39.589453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:41.199204Z","title":"Yue, Lovish Madaan, Ted Moskovitz, DJ Strouse, and Aaditya K","venue":null,"work_id":"f575bd03-dd00-41b0-944f-969469ea1e28","year":2024},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:39.717760Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:dba32bd110be458d3a17a098608c377cfcdac87a7d98fecf992a5115164fc20c","observation_id":"7e7ea553-ba40-42d5-8d1e-44a4e087f678","resolution":{"observed_at":"2026-08-07T15:33:41.345809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:40.893578Z","title":null,"venue":null,"work_id":"51c46a2f-e51f-457e-921f-a89ab55e885e","year":2024},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:39.842697Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:42a74c6f9af31d7acfdbd4b932d21a778670d2833197e35a7bb17c5c107b50a9","observation_id":"1741a15c-c033-4885-9875-fa3fa3f21992","resolution":{"observed_at":"2026-08-07T15:33:41.022751Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:39.955182Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:39.955182Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:7effc57a9f9ffefe2a0b6c239ccdeb27f7d782a4f04fa1962abef4b8791cd8d6","observation_id":"399838c1-f3f2-4451-be79-3c3ca68c1c5e","resolution":{"observed_at":"2026-08-07T15:33:39.955182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:33:40.054182Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:40.054182Z"},"links":{"citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:9f9612888f1063266c98842b9f2be0e0dd7fd2c83e0719df719e89cf2259e80f","observation_id":"d91681eb-cebd-4f0b-b0b2-3cc71d4e0111","resolution":{"observed_at":"2026-08-07T15:33:40.054182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T15:26:23.422843Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2505.14852."}