{"as_of":"2026-08-08T04:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5e28a1064c431efe2bf4b02e66e810fe59fd16d521636fcfbbdb35c0a4d1eeb3","coverage":[{"denominator":167,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:11:10.254632Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.00309/citation-record","integrity":"/paper/2506.00309/integrity","json":"/paper/2506.00309/citation-record.json","paper":"/paper/2506.00309"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:00.851613Z","title":"Liljedahl and M","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:00.851613Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:27cf725bd7bb7e10edccef4d86c6cfdbe77a3143af8ad195f8fcf2cdb72e478c","observation_id":"b126cd2a-fbb3-4fda-b06f-9013bc4a6509","resolution":{"observed_at":"2026-08-07T12:11:00.851613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:00.964008Z","title":"Students’ difficulties in mathemat- ics problem-solving: What do they say?","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:00.964008Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:b17cc438cc6326c767bcaa16f2a52830fa0763512916b62a5fe256a19981262b","observation_id":"8355b285-aa54-41ff-bde8-4feb655a3f0e","resolution":{"observed_at":"2026-08-07T12:11:00.964008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:01.073139Z","title":"Abstraction in mathematics and mathe- matics learning","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:01.073139Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:af9a7737a669146180c5e4fbca3a366290bceac35b800c979eb29b501e020be0","observation_id":"a7a106cd-a495-447c-8db9-ec08fb693083","resolution":{"observed_at":"2026-08-07T12:11:01.073139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:01.205303Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:01.205303Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:fc47a31c226f03fc3b10b7a8a8e0b3a2f284d5538ee84446b7a8f5aa69e0938b","observation_id":"eb456850-b714-4bd6-aea5-7bb16a82f320","resolution":{"observed_at":"2026-08-07T12:11:01.205303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:01.271200Z","title":"Mathematics: con- ceptions, learning and teaching,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:01.271200Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:46817455006d7388d95e3587162ffdab09982cc2e3977e1024e3921d20b2c6ae","observation_id":"476b006a-e7ed-47f3-ac23-5a4879f61bc9","resolution":{"observed_at":"2026-08-07T12:11:01.271200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:01.392215Z","title":"The nature, e ffects, and relief of mathematics anxiety,","venue":null,"work_id":null,"year":1990},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:01.392215Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:88d7468e946b4a86e26814263bf314d213e494e5c7f543ed4e2c40ea369e825b","observation_id":"0027aab8-e1c9-4dcd-b43c-3d33e7212d0b","resolution":{"observed_at":"2026-08-07T12:11:01.392215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:01.508538Z","title":"Development of ab- stract mathematical reasoning: the case of algebra,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:01.508538Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:15a94edcdc048b1cdab52de475f95e9e30188aa0e05036d0ea252d5476c55d26","observation_id":"f73b643a-24fa-4489-a760-6dd3e69393c8","resolution":{"observed_at":"2026-08-07T12:11:01.508538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:01.601971Z","title":"The logical thinking ability: Math- ematical disposition and self-regulated learning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:01.601971Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:960f930a2823b43f35becdb5f6a5fd7b18f130afdc708be1b3a6cecb85400885","observation_id":"d418b757-5124-445b-bd58-32205dd3c0a3","resolution":{"observed_at":"2026-08-07T12:11:01.601971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:01.749051Z","title":"Developing critical thinking skills of students in mathematics learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:01.749051Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:22b02b80678c68c724fa258d761f7c2af4dfb4d0d31fb1e811eeaf178ba54416","observation_id":"72f54e55-77f8-4fb1-9acd-2ee3928ead27","resolution":{"observed_at":"2026-08-07T12:11:01.749051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:01.849489Z","title":"Critical thinking: Essence for teaching mathematics and mathematics problem solving skills,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:01.849489Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:bc98f738a292c96a5cd24885791aec35839e574c270710f9ecd4229e03570ea4","observation_id":"baf5d3d6-edd2-4b35-a1c9-d3b7decf2242","resolution":{"observed_at":"2026-08-07T12:11:01.849489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:01.909174Z","title":"Artificial intelligence in mathemat- ics education: A systematic literature review,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:01.909174Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:90fa86723e0202f751ecc80f2822bd7d7af661b910474b04801ee6671ba17dac","observation_id":"5356daae-2487-421c-a372-234056285456","resolution":{"observed_at":"2026-08-07T12:11:01.909174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:02.004556Z","title":"The importance of educational technology in teaching,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:02.004556Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:9d9e66344363cacb5d236f2c872ecfafc0a1f90b66b1cbaf7e61844d00002d50","observation_id":"2b4f91e6-efca-4468-a963-dc977e05a7e4","resolution":{"observed_at":"2026-08-07T12:11:02.004556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:02.121046Z","title":"Benefits and limitations of the artificial with respect to the traditional learning of mathematics,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:02.121046Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:62b8a07faf1b4817626069a7d44dbd83dcd4bf304ec6a96a30bec3e02166f3d3","observation_id":"3a31535c-51c4-4c82-a501-8b2782b86147","resolution":{"observed_at":"2026-08-07T12:11:02.121046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:02.220955Z","title":"The use of interactive learning technologies in math classes,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:02.220955Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:370fa3813f0a94b31ba275a3dadca9fe89d9868d9fad32563be63c90f6e19c04","observation_id":"8b125688-d6e3-4666-87d5-400f89c2fa89","resolution":{"observed_at":"2026-08-07T12:11:02.220955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:02.300441Z","title":"Going the distance with on- line education,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:02.300441Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:51fc07b1320e0e0736eadc8dbb87c48d437fc138520f34e10c8690b50176e608","observation_id":"c1e65fd8-e24f-4586-9b25-053995444cfb","resolution":{"observed_at":"2026-08-07T12:11:02.300441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:02.422984Z","title":"Natural language processing in the era of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:02.422984Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:c25b79164b1acb9bdd975eeda686585b77903f9025aee7e8b31064dbc6bbd2e7","observation_id":"cfd6c230-e9e3-4fd4-b9d8-10e63d29e16e","resolution":{"observed_at":"2026-08-07T12:11:02.422984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:02.510129Z","title":"An introduction to key technology in artifi- cial intelligence and big data driven e-learning and e-education,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:02.510129Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:58222aef488d5abb0f4e06188b8ce3f9196ee5becb39c03d4ae29650cc317f39","observation_id":"74b81c41-a281-4874-a06a-9c20d8d59247","resolution":{"observed_at":"2026-08-07T12:11:02.510129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:02.611345Z","title":"Learning mathematics with large language models: A comparative study with computer algebra systems and other tools,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:02.611345Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:825abc1fc07d75d2de6f69f94a9cd42009dd7bf9acdaea358c8b79a90b4b513f","observation_id":"6136ad48-370b-4084-ac5d-ff93b68d82c2","resolution":{"observed_at":"2026-08-07T12:11:02.611345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:02.735379Z","title":"Johnsen, Large language models (LLMs)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:02.735379Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:f498046db7a9cb58dc4a5c260481c97a633bf02f97eb8d936eadcb1502c9773f","observation_id":"1835dec6-fc06-4e6b-b90b-2263b2075583","resolution":{"observed_at":"2026-08-07T12:11:02.735379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:02.841784Z","title":"Talking about large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:02.841784Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:a986a34b9a16bbfd71035e8f61466e97d5e873d365e7d530022329550eb58354","observation_id":"cbd35221-ecf3-4956-a89f-45298c8ae694","resolution":{"observed_at":"2026-08-07T12:11:02.841784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:02.926949Z","title":"A survey on large language mod- els: Applications, challenges, limitations, and practical usage,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:02.926949Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:b5ec796ae3559c924394b9913c8b48f3ded8df18a95bd36a0aa91a3b4ea3a79a","observation_id":"08562342-160e-4ef3-b401-acc1c91add5c","resolution":{"observed_at":"2026-08-07T12:11:02.926949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-07T12:11:03.019514Z","title":"A survey of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:03.019514Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:d366e264633e8ce1f41be03ed653002917777dc2bb936a2f02512a02665addcc","observation_id":"c27f8372-8ac1-4df7-8b9d-0982952807a7","resolution":{"observed_at":"2026-08-07T12:11:03.019514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10169","last_updated":"2023-07-19T17:55:13Z","snapshot_observed_at":"2026-07-06T15:55:59.949673Z","submitted_at":"2023-07-19T17:55:13Z","title":"Challenges and Applications of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10169","snapshot_observed_at":"2026-08-07T12:11:03.124472Z","title":"Challenges and applications of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:03.124472Z"},"links":{"cited_paper":"/paper/2307.10169","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:c3cf366a55184e55d1907b7b48a72dc874e4344e6f0c93f38026a06f3f03581c","observation_id":"caa62ccc-1abb-4958-bcc5-1c7c78906114","resolution":{"observed_at":"2026-08-07T12:11:03.124472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:03.227877Z","title":"The evolution of human-computer interaction: From com- mand lines to conversational interfaces powered by large language mod- els,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:03.227877Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:c3bc4de21a617dd84e704707dbdd2235e4c9112a4b9f1bac9acd63475cf5c248","observation_id":"ae56251e-4ab6-4df1-8ff0-091ee9645c41","resolution":{"observed_at":"2026-08-07T12:11:03.227877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:03.303568Z","title":"Enhancing human-computer in- teraction through ai: A study on chatgpt in educational environments,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:03.303568Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:5f2eb4da3635eead9a6ee5f6b6a6acef30a9e650020f41e17ad22a7544b3b75c","observation_id":"ae609cdc-789a-4d7f-83ba-6d04cfc3e662","resolution":{"observed_at":"2026-08-07T12:11:03.303568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:03.407113Z","title":"Large language models: a com- prehensive survey of its applications, challenges, limitations, and future prospects,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:03.407113Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:1e5c05c280bdef2f3ccb04ab225c73ba41560b4eeae7622ef962198368ebc5d9","observation_id":"4fafd64c-ae9b-4fec-adb1-3f4fd71a15b9","resolution":{"observed_at":"2026-08-07T12:11:03.407113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13410","last_updated":"2024-11-20T15:52:03Z","snapshot_observed_at":"2026-07-06T19:53:12.584883Z","submitted_at":"2024-11-20T15:52:03Z","title":"A Survey On Enhancing Reinforcement Learning in Complex Environments: Insights from Human and LLM Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13410","snapshot_observed_at":"2026-08-07T12:11:03.514978Z","title":"A survey on enhancing reinforce- ment learning in complex environments: Insights from human and llm feedback,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:03.514978Z"},"links":{"cited_paper":"/paper/2411.13410","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:27079291fded9e0399e7b2b0bea755d3a6ef97f33d6209fe790e14302dd32991","observation_id":"2af1b1a6-5461-4764-9987-518e640f6b4c","resolution":{"observed_at":"2026-08-07T12:11:03.514978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:03.616330Z","title":"A multifaceted vision of the human-ai collaboration: a comprehensive review,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:03.616330Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:5bbfa1d515a32effbcf405f879ec954e510da5fb0133c039ae440ccc29724fe5","observation_id":"dd3caf2d-706a-4b30-9097-e14c138d2660","resolution":{"observed_at":"2026-08-07T12:11:03.616330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:03.706929Z","title":"Practical and ethical challenges of large lan- guage models in education: A systematic scoping review,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:03.706929Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:f7776d9e41abbd117a931e3f583fc88fac3f14176e22697684b5b82836c89579","observation_id":"c8b03f50-99f3-4f96-a9d8-c5c2fc5b8c34","resolution":{"observed_at":"2026-08-07T12:11:03.706929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:03.819765Z","title":"Challenges and future directions of big data and artificial intelligence in education,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:03.819765Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:a29da623c8a63a76844ecdb09b2b55a1d925ddaa171402aaa38ada8c58a2d451","observation_id":"37bb07f1-3cbb-4c5f-8bff-0f4ba58da239","resolution":{"observed_at":"2026-08-07T12:11:03.819765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:03.933432Z","title":"Exploring the possibility and implementation of ai- supported online math coaching,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:03.933432Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:670a0ef4f34ff06b05dbd0d8aee34fa29b99556af116b48fb1e4259eb165e162","observation_id":"9aab7e55-00a7-4628-b92c-f367da63a234","resolution":{"observed_at":"2026-08-07T12:11:03.933432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:04.064556Z","title":"Artificial intelligence in mathemat- ics education: The good, the bad, and the ugly,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:04.064556Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:0303ea4d0c574f6fdea63e26fdbbad2d469951bca065dc8ab51db38dee77ab17","observation_id":"59e23953-e45e-420f-bfed-f5006c0ae27d","resolution":{"observed_at":"2026-08-07T12:11:04.064556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:04.184768Z","title":"Information analysis of advanced mathematics education- adaptive algorithm based on big data,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:04.184768Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:04be9ca9453adfec6feaf54e7740b72d9ba3f1e027f962b47ab9f20e7bd470c4","observation_id":"58f15af5-3b03-46b3-ba1d-d92448182945","resolution":{"observed_at":"2026-08-07T12:11:04.184768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:04.275157Z","title":"Deep learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:04.275157Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:76ac30d4b8edb7c6301dba1a804da2cf93ce3f471303a455a9d833e87dbaf4b5","observation_id":"44e3992f-ddd7-4f73-a1cf-372811cafc6f","resolution":{"observed_at":"2026-08-07T12:11:04.275157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:04.448313Z","title":"Development and application of artificial neu- ral network,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:04.448313Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:4ae95dfa80c2b555b69c1c2b0e91d6afd874add814126e87a68bd798ca45a3ef","observation_id":"c2bf6fd4-a8dc-4e3b-8be2-ac8406590155","resolution":{"observed_at":"2026-08-07T12:11:04.448313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:04.554772Z","title":"Large language models (llms): survey, technical frameworks, and future challenges,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:04.554772Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:95717801531efe630fa6d931f1ccddf1182cfd3926a7c875435d80d06850b36f","observation_id":"4b4af792-23f8-4385-bec1-f176ca4608d1","resolution":{"observed_at":"2026-08-07T12:11:04.554772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:04.629357Z","title":"When large language models meet personal- ization: Perspectives of challenges and opportunities,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:04.629357Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:0e2350ce384d5c7014ac7d0e927f290a1320d2173018e4153faed49ed84285ed","observation_id":"b2e6f0ab-bde4-4160-9b32-623db9971058","resolution":{"observed_at":"2026-08-07T12:11:04.629357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00515","last_updated":"2024-11-10T22:02:27Z","snapshot_observed_at":"2026-07-29T20:40:25.374189Z","submitted_at":"2024-06-01T17:48:15Z","title":"A Survey on Large Language Models for Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00515","snapshot_observed_at":"2026-08-07T12:11:04.753361Z","title":"A survey on large lan- guage models for code generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:04.753361Z"},"links":{"cited_paper":"/paper/2406.00515","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:b7ec63cf307bf0570670f3bf1c5c61c900eed3fb8c24b6c1ab9d6503ce0ade1f","observation_id":"4352d3f5-fbd5-4089-9060-5a911084ff2d","resolution":{"observed_at":"2026-08-07T12:11:04.753361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18041","last_updated":"2024-02-28T04:35:51Z","snapshot_observed_at":"2026-07-06T17:36:36.437597Z","submitted_at":"2024-02-28T04:35:51Z","title":"Datasets for Large Language Models: A Comprehensive Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18041","snapshot_observed_at":"2026-08-07T12:11:04.838038Z","title":"Datasets for large language models: A comprehensive survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:04.838038Z"},"links":{"cited_paper":"/paper/2402.18041","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:c09eb8abc0d245aa13f290e1cf03381bdbd9540281894f59bc2c6b83b3551487","observation_id":"d0fe05dd-d75b-4337-905d-ca5461442db7","resolution":{"observed_at":"2026-08-07T12:11:04.838038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:04.931898Z","title":"Harnessing large language mod- els’ zero-shot and few-shot learning capabilities for regulatory research,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:04.931898Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:e10966c0c4f466cc0b2d599cd1fa2906f5fb4ef8efcf38a5e87189ec85651354","observation_id":"1d131f1f-497f-418c-a913-6be5f6a52b18","resolution":{"observed_at":"2026-08-07T12:11:04.931898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:05.029752Z","title":"Alto, Modern Generative AI with ChatGPT and OpenAI Models: Leverage the capabilities of OpenAI’s LLM for productivity and inno- vation with GPT3 and GPT4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.029752Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:9a735863466329c8aec6671915b901c0aba5b80b680c90bf39cbd5a4296f8e4e","observation_id":"b7857093-262e-4a0b-9f54-230f61b8af7f","resolution":{"observed_at":"2026-08-07T12:11:05.029752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:05.126570Z","title":"Google gemini as a next generation ai educational tool: a review of emerging educational technology,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.126570Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:099727614c720442057eb7272b840a1fb7306743ecdf51f603bffac1bcdfc7fa","observation_id":"b69087e0-5f88-4787-a5e6-448fc5662e1a","resolution":{"observed_at":"2026-08-07T12:11:05.126570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:05.204977Z","title":"A survey of deepseek models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.204977Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:3639bfbfbbb741e62663f8d960e6149c7a2a7af1d928223be033111568d12049","observation_id":"c2e3d4f3-0c0e-49e4-82a2-a01a357d685f","resolution":{"observed_at":"2026-08-07T12:11:05.204977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04783","last_updated":"2025-02-25T19:55:35Z","snapshot_observed_at":"2026-08-07T17:49:05.909948Z","submitted_at":"2025-02-25T19:55:35Z","title":"Comparative Analysis Based on DeepSeek, ChatGPT, and Google Gemini: Features, Techniques, Performance, Future Prospects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04783","snapshot_observed_at":"2026-08-07T12:11:05.309517Z","title":"Comparative analysis based on deepseek, chatgpt, and google gem- ini: Features, techniques, performance, future prospects,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.309517Z"},"links":{"cited_paper":"/paper/2503.04783","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:98a6e6bf9bbbe3c0fdfc909433c64594ef64c74dc5c388fb7a2a2f2f35100a08","observation_id":"012911c5-e066-487b-912c-b909f6b4843a","resolution":{"observed_at":"2026-08-07T12:11:05.309517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:05.439080Z","title":"Bias and fairness in large language models: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.439080Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:ed6879b984f9b21c78189f3f9f854705ac72de3e9bafbadd2a3e4ccfb28acec0","observation_id":"3990a575-fd8d-488f-bc84-f2c124418b41","resolution":{"observed_at":"2026-08-07T12:11:05.439080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:05.528866Z","title":"Large language models (llm) in compu- tational social science: prospects, current state, and challenges,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.528866Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:2551a26b6630aec2a398a878509b161d787331853f2ebb062806a2b5faf78e61","observation_id":"f23486ab-3635-4929-b30f-6057e900c13f","resolution":{"observed_at":"2026-08-07T12:11:05.528866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:05.611256Z","title":"Foundation and large language models: fundamentals, challenges, op- portunities, and social impacts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.611256Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:a5b55b136a1128a828a4b4cbdd95f14c95b02e0a30e9daa9b7e102964b538e01","observation_id":"9fa01db6-8877-4789-aed3-4f2cc81ce452","resolution":{"observed_at":"2026-08-07T12:11:05.611256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:05.736888Z","title":"Llm challenges and solutions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.736888Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:c95ce315fa560d9899801d4ff4f4a89ad4ff6a022f8dea8f146808e6fc29805c","observation_id":"e2176361-e4c1-46bb-8a54-fecb6e9666bf","resolution":{"observed_at":"2026-08-07T12:11:05.736888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:05.838896Z","title":"A step-by-step solution methodology for mathematical expressions,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.838896Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:b458cc0f95dcd10cb5d003bb7d5f9e96278ef52d0b7817bbd4c04693917dbec2","observation_id":"ee991bde-b2c9-47c7-a839-2e2611e92eac","resolution":{"observed_at":"2026-08-07T12:11:05.838896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:05.917752Z","title":"Solving mathematical problems using large language models: A survey,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:05.917752Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:b658c5e0c71d9aac8ff770d97f7318d34d93933b07b1dff788922b9fa603637f","observation_id":"45af079e-53e1-4438-aff2-a36e7c0570c1","resolution":{"observed_at":"2026-08-07T12:11:05.917752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05713","last_updated":"2025-02-20T15:16:06Z","snapshot_observed_at":"2026-07-06T16:04:58.235073Z","submitted_at":"2023-08-10T17:22:28Z","title":"Testing GPT-4 with Wolfram Alpha and Code Interpreter plug-ins on math and science problems","version":4},"cited_work":{"arxiv_id":"2308.05713","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.05713","snapshot_observed_at":"2026-08-07T12:11:19.048599Z","title":"Testing GPT-4 with Wolfram Alpha and Code Interpreter plug-ins on math and science problems","venue":"cs.AI","work_id":"950cd52d-7d67-4e9d-924a-b50c5e3335b4","year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:06.046481Z"},"links":{"cited_paper":"/paper/2308.05713","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:3551e4883b132c610fffca4c99ed6fc4c2456941fc95dfc4e0dd0881bccd67d7","observation_id":"fb72275c-326f-400e-91e2-b7fd7e4764d5","resolution":{"observed_at":"2026-08-07T12:11:19.122358Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:06.170880Z","title":"Assessing the performance of ai-generated code: A case study on github copilot,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:06.170880Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:e5670fc9f05c9453b14dc34d37204f73114d51ce1857978346b14391e245ca07","observation_id":"7df8c725-2ba5-407e-9ecf-879bd0badedb","resolution":{"observed_at":"2026-08-07T12:11:06.170880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16673","last_updated":"2023-10-25T14:38:40Z","snapshot_observed_at":"2026-08-04T08:38:17.884154Z","submitted_at":"2023-10-25T14:38:40Z","title":"Exploring Large Language Models for Code Explanation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16673","snapshot_observed_at":"2026-08-07T12:11:06.303541Z","title":"Exploring large language models for code explanation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:06.303541Z"},"links":{"cited_paper":"/paper/2310.16673","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:016efaf9e57be32fa06589377830c52de355a2988d78f53144521ed79264bbd7","observation_id":"ed7b28c0-6349-4941-bb6e-e8fc0788fae2","resolution":{"observed_at":"2026-08-07T12:11:06.303541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:06.395561Z","title":"Automatic programming: Large language models and beyond,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:06.395561Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:807cca1531444a8a79dda73e725a089f8a3dc880544c7960e46435af442dc60a","observation_id":"a98a37f7-2523-40ff-bac3-7ccbd941818a","resolution":{"observed_at":"2026-08-07T12:11:06.395561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:06.509590Z","title":"Intelligent computing: the latest advances, challenges, and future,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:06.509590Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:567b23a6c33914a9750bdddfdabf8feb0d1390a1b269aaaffeab7bc1e1f2f224","observation_id":"cfbc08c1-5198-46d5-a96f-8f1d4f0dbea6","resolution":{"observed_at":"2026-08-07T12:11:06.509590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:06.589247Z","title":"Bridging machine learning and logical reasoning by abductive learning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:06.589247Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:4f15fff4f2976f35ac8f2cdf22ed61a911f2ed75d6952e6d8f8ec83f8b79e615","observation_id":"53128e99-3706-43cf-8a71-54d14cac1662","resolution":{"observed_at":"2026-08-07T12:11:06.589247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12209","last_updated":"2024-05-20T17:52:29Z","snapshot_observed_at":"2026-07-06T18:16:51.116432Z","submitted_at":"2024-05-20T17:52:29Z","title":"MathBench: Evaluating the Theory and Application Proficiency of LLMs with a Hierarchical Mathematics Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12209","snapshot_observed_at":"2026-08-07T12:11:06.681146Z","title":"Mathbench: Evaluating the theory and application proficiency of llms with a hierarchical mathematics benchmark,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:06.681146Z"},"links":{"cited_paper":"/paper/2405.12209","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:5719d14f196c746a308a2956efee5ee1ca0363b5703181097469c5de7489c82e","observation_id":"74b9d6e3-901c-4cb0-827e-7c7c600334f7","resolution":{"observed_at":"2026-08-07T12:11:06.681146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:06.774134Z","title":"Metacog- nitive capabilities of llms: An exploration in mathematical problem solv- ing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:06.774134Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:1a792f83257ec0675a3122c77a472e4429185d98fdb4c7612e0ecf65079ef358","observation_id":"bf914875-85f5-4cec-80e6-5bdb60b86345","resolution":{"observed_at":"2026-08-07T12:11:06.774134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18486","last_updated":"2023-07-05T16:19:38Z","snapshot_observed_at":"2026-08-04T15:30:23.647107Z","submitted_at":"2023-05-29T12:37:21Z","title":"A Systematic Study and Comprehensive Evaluation of ChatGPT on Benchmark Datasets","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18486","snapshot_observed_at":"2026-08-07T12:11:06.862023Z","title":"A systematic study and comprehensive evaluation of chat- gpt on benchmark datasets,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:06.862023Z"},"links":{"cited_paper":"/paper/2305.18486","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:622a8ebb3abb279040fd0760090245c8d94485eebe62ff5edf6725d6e3e4e95d","observation_id":"c2b25631-689f-4039-a697-f7538705028e","resolution":{"observed_at":"2026-08-07T12:11:06.862023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:06.927980Z","title":"A survey on evaluation of large language mod- els,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:06.927980Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:6890237ff77edca9792278cf3d01ac8df0f8b5bf082a7a2c857009eaa7440a10","observation_id":"33f473ca-fd4f-497b-88a3-c35520879755","resolution":{"observed_at":"2026-08-07T12:11:06.927980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.028464Z","title":"Surampudi, Big Data Meets LLMs: A New Era of Incident Monitor- ing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:07.028464Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:80583ad7fa090d97a5c1490c8bc3508eb66becd28616cdb3a1aa09b5d5ec5f37","observation_id":"cd97d080-e80a-479c-9490-2982e88b4b04","resolution":{"observed_at":"2026-08-07T12:11:07.028464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.149322Z","title":"E ffect of chat gpt on the digitized learning process of university students,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:07.149322Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:d53069105f0521392e589312cf7cc66084a4c0b9b260e0a79cd0d5e65e9406d0","observation_id":"7f88e224-53e0-4d3b-9215-3a8af6ef2c3a","resolution":{"observed_at":"2026-08-07T12:11:07.149322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.250637Z","title":"The e ffects of over-reliance on ai dialogue systems on students’ cognitive abilities: a systematic review,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:07.250637Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:ce7b73245e387fe45f497e2a1453a321ce29a97611322543906b59a0e0fbd71a","observation_id":"f84551d4-ecfb-4656-9020-79b536764ebb","resolution":{"observed_at":"2026-08-07T12:11:07.250637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.329186Z","title":"Chatgpt: The end of online exam in- tegrity?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:07.329186Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:ee2a070193a4af53a97d20f3382ab614d1aa264da524a942f14cee47de370928","observation_id":"d68c9621-1e78-4617-be13-df4c8da886be","resolution":{"observed_at":"2026-08-07T12:11:07.329186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.412204Z","title":"Ethical principles for artificial intelligence in education,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:07.412204Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:3a299fd4d1552a57d2ec8165a6148b8de23846cc077f419d63ca4adc2c79f149","observation_id":"33ff6b33-a55c-4a90-a9f9-fe22356fe051","resolution":{"observed_at":"2026-08-07T12:11:07.412204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16075","last_updated":"2024-12-20T17:19:24Z","snapshot_observed_at":"2026-08-05T03:18:11.955456Z","submitted_at":"2024-12-20T17:19:24Z","title":"Formal Mathematical Reasoning: A New Frontier in AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16075","snapshot_observed_at":"2026-08-07T12:11:07.530445Z","title":"Formal mathematical reasoning: A new frontier in ai,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:07.530445Z"},"links":{"cited_paper":"/paper/2412.16075","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:154cb2306a5c2625f55600673713ac7f08471dd817f5659a45fb343690cdc3ee","observation_id":"10a97baa-5882-4fe7-adba-ef79bab38783","resolution":{"observed_at":"2026-08-07T12:11:07.530445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.614786Z","title":"Generative ai and future education: a review, theoretical validation, and authors’ perspective on challenges and solutions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:07.614786Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:f028062e97c524cd2ddc63d51d564b7b45ab07dd081cf74a44ddc5367c2decf1","observation_id":"e951661c-e566-4beb-b14b-8a0c537bafcb","resolution":{"observed_at":"2026-08-07T12:11:07.614786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02029","last_updated":"2025-05-19T03:42:27Z","snapshot_observed_at":"2026-07-06T16:14:22.182217Z","submitted_at":"2023-09-05T08:15:00Z","title":"The Impact of Artificial Intelligence on the Evolution of Digital Education: A Comparative Study of OpenAI Text Generation Tools including ChatGPT, Bing Chat, Bard, and Ernie","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02029","snapshot_observed_at":"2026-08-07T12:11:07.684271Z","title":"The impact of artificial intelligence on the evolution of digital education: A compara- tive study of openai text generation tools including chatgpt, bing chat, bard, and ernie,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:07.684271Z"},"links":{"cited_paper":"/paper/2309.02029","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:cd3b54c424572801afe672a92953d676bec31bb28460b64dce60f2acca7ff2a6","observation_id":"b3dc2917-2999-4746-b55a-968045811af5","resolution":{"observed_at":"2026-08-07T12:11:07.684271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.756693Z","title":"Machine learning and deep learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:07.756693Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:d5fc1ed5fde3703d09a03a27cffe3a93e7d3a59a3025a5db42125a6675c31948","observation_id":"d5143984-5a8c-4b22-a447-02cc5aff939b","resolution":{"observed_at":"2026-08-07T12:11:07.756693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.849842Z","title":"Deep learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:07.849842Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:ef7e02f8cf2a0f11d9de78e30be3bc5b34cf1a7c8f8b96b03ff2a6205f45f793","observation_id":"94238204-d254-4503-97fc-64632728c0df","resolution":{"observed_at":"2026-08-07T12:11:07.849842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.907581Z","title":"Scaling laws of data- driven machine learning models: A survey and taxonomy,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:07.907581Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:de723faa9fdeabb2c071a77de560b116cb3671a4732a064c2337ea109bd9f0be","observation_id":"d48275ff-36df-4918-a769-289e5ccb8da6","resolution":{"observed_at":"2026-08-07T12:11:07.907581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:07.966899Z","title":"Deep learning & its applications,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:07.966899Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:14772d1d0fc2fca9e4daf068598214d7e038a9a13b062f004ec1beb9d56f8a8e","observation_id":"df2893db-3024-4993-a7a3-24f17d12ddda","resolution":{"observed_at":"2026-08-07T12:11:07.966899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.034045Z","title":"Deep learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.034045Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:48212f4dc8fabd5df40eb0ab904df461f6f653aa37ee2d3e17ca7e794f88e1e0","observation_id":"d4ba57f3-414b-45d7-aa67-3f1b78852a1f","resolution":{"observed_at":"2026-08-07T12:11:08.034045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.104136Z","title":"Mehrotra, Basics of artificial intelligence & machine learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.104136Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:f3644a41124208dca5990cc4e9e9b4b46c882568fdef241a13491e8277d18326","observation_id":"0498e75f-08ff-461b-92d0-60b4cc11a5e3","resolution":{"observed_at":"2026-08-07T12:11:08.104136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.201998Z","title":"A study of challenges and limitations to ap- plying machine learning to highly unstructured data,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.201998Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:6c8ec355cbe31dcb299eaae565a72498e7e7de2c83ce80d5d70fb5fb5f6009d1","observation_id":"c9be37da-968e-4398-b136-150d2f39f50d","resolution":{"observed_at":"2026-08-07T12:11:08.201998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.257518Z","title":"Supervised learning,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.257518Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:6874373f41a3c27da865cb191e221740fcb5d05c5bdd3eea42fca11705ed6ef5","observation_id":"9b5cc850-5ebb-4ab5-946d-34114026904d","resolution":{"observed_at":"2026-08-07T12:11:08.257518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.327675Z","title":"Self- attention and transformers: Driving the evolution of large language mod- els,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.327675Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:4ea44a547357d5bde4339d60a4a03aaeedd80cf6c6077061145645c2403cb0b3","observation_id":"1b5c9c74-44db-46f5-bd0b-0c3e6ae0dc8b","resolution":{"observed_at":"2026-08-07T12:11:08.327675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.393988Z","title":"A review on large language models: Architectures, applications, taxonomies, open issues and challenges,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.393988Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:77c1bbff58a65214c48ed89571eb8327e2cb8bc92448f8635db1660a97fa3b7e","observation_id":"75359080-5c58-4fa0-b19c-80c16893de67","resolution":{"observed_at":"2026-08-07T12:11:08.393988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.498428Z","title":"Large language models, fine tuning, code generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.498428Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:a230bdd7e7bdde5faff5c3f5582d7713d96eb0b84c1ae0afffbfa61f1fad8db5","observation_id":"03a91b66-46ab-40d4-bfe9-99c408b0ce13","resolution":{"observed_at":"2026-08-07T12:11:08.498428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.566597Z","title":"Machine learning and deep learning for big data analytics: A review of methods and applications,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.566597Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:375890c81c00e72698436c69ef6ad1841ad64651a89d4a38dc3276be8f737baf","observation_id":"4f8dde0f-ae85-4fb4-8011-058c2aa96374","resolution":{"observed_at":"2026-08-07T12:11:08.566597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.617970Z","title":"Chatgpt and open-ai models: A preliminary review,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.617970Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:134ccafa5479923a0f39542dcb7be5a45c17b361d1cba347d6888d39f146c7bd","observation_id":"edfd2758-a0d0-4373-b05c-89b60cfa1294","resolution":{"observed_at":"2026-08-07T12:11:08.617970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.676334Z","title":"Gpt (generative pre-trained transformer)–a comprehensive re- view on enabling technologies, potential applications, emerging chal- lenges, and future directions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.676334Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:e50875f8568c059c952dfb496928187cd6bac71a593a5729bc3c53824ec69b08","observation_id":"fed8dbd0-2a98-498a-857b-5761f7812927","resolution":{"observed_at":"2026-08-07T12:11:08.676334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.733316Z","title":"Research on text classification model based on self-attention mechanism and multi-neural network","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.733316Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:2b2b4bba71f24a9ed84df919f9684ff086b60e1672d4e5b370798d3d930b1a65","observation_id":"aea37d90-4e23-4bf7-aab0-22c12d9519a7","resolution":{"observed_at":"2026-08-07T12:11:08.733316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.822768Z","title":"Chatgpt–technical research model, capability analysis, and application prospects,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.822768Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:3ceeebfff1256aac7706bb9f537e3113e2346fb22c3b5e599f700873ce54efe6","observation_id":"697c5d3a-f515-49fb-9b41-7bee1d751912","resolution":{"observed_at":"2026-08-07T12:11:08.822768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.901088Z","title":"A sur- vey of reinforcement learning from human feedback,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.901088Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:d9ae931fa891d2af11af39adec34a7680264dcd182dffa327e160435b1a2e49c","observation_id":"2a5fe638-4672-45d3-b6c5-93ebaecab853","resolution":{"observed_at":"2026-08-07T12:11:08.901088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:08.971340Z","title":"Summary of chatgpt-related research and perspective towards the future of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:08.971340Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:28e73954738758c75fbdbd09530530df179e0704e1894968e291a0592f1425d1","observation_id":"ab55b070-2f43-4cd9-9836-b9f5f14f023c","resolution":{"observed_at":"2026-08-07T12:11:08.971340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12057","last_updated":"2023-08-26T19:29:03Z","snapshot_observed_at":"2026-07-06T15:57:16.688338Z","submitted_at":"2023-07-05T17:05:32Z","title":"External Reasoning: Towards Multi-Large-Language-Models Interchangeable Assistance with Human Feedback","version":2},"cited_work":{"arxiv_id":"2307.12057","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.12057","snapshot_observed_at":"2026-08-07T12:11:18.648640Z","title":"External Reasoning: Towards Multi-Large-Language-Models Interchangeable Assistance with Human Feedback","venue":"cs.CL","work_id":"ec962fc2-2e2e-4f17-9606-9b27a1ac50f5","year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:09.034004Z"},"links":{"cited_paper":"/paper/2307.12057","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:3122e4477cc854a39bea85df759a496e07784a7da746769696074fc605df6546","observation_id":"a1bd029c-0381-4646-9d80-b1144f68e6f0","resolution":{"observed_at":"2026-08-07T12:11:18.745298Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:09.164900Z","title":"Use of language by generative ai tools in mathematical problem solving: The case of chatgpt,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:09.164900Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:a369154ddc30da55e5c6dee228d8cd80fbee77db20dff8eb9c923c5fe7446547","observation_id":"7cdd153a-f3c0-4418-80ba-91966e5d3d4f","resolution":{"observed_at":"2026-08-07T12:11:09.164900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06331","last_updated":"2023-10-31T08:21:20Z","snapshot_observed_at":"2026-08-08T01:21:47.968828Z","submitted_at":"2023-06-10T02:01:02Z","title":"Investigating the Effectiveness of ChatGPT in Mathematical Reasoning and Problem Solving: Evidence from the Vietnamese National High School Graduation Examination","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.06331","snapshot_observed_at":"2026-08-07T12:11:09.261782Z","title":"Investigating the e ffectiveness of chatgpt in mathematical reasoning and problem solving: Evidence from the viet- namese national high school graduation examination,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:09.261782Z"},"links":{"cited_paper":"/paper/2306.06331","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:e6b611c37437943d9896cc98f97407c82a1bdcd40f346a81df7d11612b26f53e","observation_id":"c8f1fda9-08b2-4a2e-9adb-4c7b5f61817c","resolution":{"observed_at":"2026-08-07T12:11:09.261782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:09.359604Z","title":"Chatgpt challenges blended learning methodologies in engineering education: A case study in mathematics,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:09.359604Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:15ad28700c64f2a476e8d88fc1863db61c86b4720f1bfa998956a9b8fb21a499","observation_id":"7298970c-09c7-4245-95e3-d23a0ac2c79d","resolution":{"observed_at":"2026-08-07T12:11:09.359604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:09.482133Z","title":"Mathematical capabilities of chatgpt,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:09.482133Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:6e2cbeb54b0b9f4aed645de0b18cbbb38558eb0ab480fe66d12faed507bd81ae","observation_id":"1d3785e1-dde0-4be5-ac83-5b75ba519f00","resolution":{"observed_at":"2026-08-07T12:11:09.482133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:09.546459Z","title":"Deepseek and china’s ai renaissance: The rise of the four dragons and six tigers,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:09.546459Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:2203b98aad3be36d01e7026a7eabfec43fe9aec61db7b47263e6173d2c37118a","observation_id":"67433008-2cf1-44ba-a04f-4711df9cb7ad","resolution":{"observed_at":"2026-08-07T12:11:09.546459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:09.648870Z","title":"Deepseek large-scale model: technical analysis and develop- ment prospect,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:09.648870Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:faee10316cac32eff62b70a04f2ca1656fbf36e6ee4badca460f7a76972698b4","observation_id":"18f0856f-b509-44a9-a600-6914d7f66824","resolution":{"observed_at":"2026-08-07T12:11:09.648870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:09.719666Z","title":"Deepseek models: A comprehensive survey of methods and applications","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:09.719666Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:bd40cb1db7f8c562d7262396235058dc09b6de6bdc7de7ed5ff17a6e62469c1a","observation_id":"76dec044-029b-4a62-9844-88bf07db8be8","resolution":{"observed_at":"2026-08-07T12:11:09.719666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:09.806021Z","title":"A survey on complex reasoning of large language models through the lens of self-evolution,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:09.806021Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:ef507142d840965469945bf089e9296dd7a97f60b3998a0383072706de012ecf","observation_id":"b9b50c11-9897-47a6-be1d-c90933844780","resolution":{"observed_at":"2026-08-07T12:11:09.806021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16352","last_updated":"2025-01-18T20:17:31Z","snapshot_observed_at":"2026-08-05T12:47:08.431760Z","submitted_at":"2025-01-18T20:17:31Z","title":"Mixture of Experts (MoE): A Big Data Perspective","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16352","snapshot_observed_at":"2026-08-07T12:11:09.882800Z","title":"Mixture of experts (moe): A big data perspective,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:09.882800Z"},"links":{"cited_paper":"/paper/2501.16352","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:8ac8e56947a884cfe9bdda1dbf3e77dccf51001ad80d3bfd519ea4fc4f5290df","observation_id":"0b3d66c9-629a-4f0a-b757-1d14139289b9","resolution":{"observed_at":"2026-08-07T12:11:09.882800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06072","last_updated":"2025-08-01T01:52:05Z","snapshot_observed_at":"2026-08-07T17:20:39.665338Z","submitted_at":"2025-03-08T05:41:42Z","title":"A Survey on Post-training of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06072","snapshot_observed_at":"2026-08-07T12:11:09.974387Z","title":"A survey on post-training of large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:09.974387Z"},"links":{"cited_paper":"/paper/2503.06072","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:e2078366913d2f4c780ec2de2448563e6a2e9f95b4a957e5dc6195690c603400","observation_id":"4e07f3b8-42ad-4c95-960f-c9b06133f978","resolution":{"observed_at":"2026-08-07T12:11:09.974387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:11:10.062753Z","title":"Ai for mathematics,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:10.062753Z"},"links":{"citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:9eca5fc3f0662a4a3ccbf26fff207e88559cbfb87bf351264018035b6b991c6f","observation_id":"1703d79e-8fba-40db-aff5-a08ceeaaafb4","resolution":{"observed_at":"2026-08-07T12:11:10.062753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10428","last_updated":"2025-04-05T13:51:05Z","snapshot_observed_at":"2026-08-03T17:13:47.294591Z","submitted_at":"2025-02-07T14:24:43Z","title":"Dynamic Chain-of-Thought: Towards Adaptive Deep Reasoning","version":4},"cited_work":{"arxiv_id":"2502.10428","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.10428","snapshot_observed_at":"2026-08-07T12:11:18.363214Z","title":"Dynamic Chain-of-Thought: Towards Adaptive Deep Reasoning","venue":"cs.AI","work_id":"ed94d463-1647-497d-8d45-018686975af8","year":2025},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:10.156882Z"},"links":{"cited_paper":"/paper/2502.10428","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:ff65024515cfc230c01dafc43cc3b62b8f4c28347cb9c287c7db98cdcdaa91c2","observation_id":"ecad3f9b-6d8c-4f23-b9f3-98f63d458747","resolution":{"observed_at":"2026-08-07T12:11:18.461725Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T12:11:10.254632Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving","version":3},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:10.254632Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.00309"},"observation_digest":"sha256:0f5ef146ce9c9dbc17feabd11b99e71647c83d4c638de312c4d6ee2e64fade03","observation_id":"5939c403-35e4-41bb-a2d5-56fba4c69b7c","resolution":{"observed_at":"2026-08-07T12:11:10.254632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.00309","last_updated":"2025-06-28T05:54:45Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T23:21:38.558900Z","submitted_at":"2025-05-30T23:37:37Z","title":"Evaluation of LLMs for mathematical problem solving"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":97,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":167},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 100 of 167 outbound references and 0 inbound Pith citation observations for arXiv:2506.00309."}