{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:6O3VAIXJK7YT2QG27RNM246KXB","short_pith_number":"pith:6O3VAIXJ","schema_version":"1.0","canonical_sha256":"f3b75022e957f13d40dafc5acd73cab868838f6a6df410546bfe98e2a1959f6f","source":{"kind":"arxiv","id":"2505.23754","version":2},"attestation_state":"computed","paper":{"title":"DeepTheorem: Advancing LLM Reasoning for Theorem Proving Through Natural Language and Reinforcement Learning","license":"http://creativecommons.org/licenses/by-nc-nd/4.0/","headline":"","cross_cats":["cs.AI"],"primary_cat":"cs.CL","authors_text":"Dong Yu, Haitao Mi, Jiahao Xu, Linfeng Song, Qiuzhi Liu, Rui Wang, Tian Liang, Yansi Li, Zhaopeng Tu, Zhenwen Liang, Zhiwei He, Zhuosheng Zhang, Ziyin Zhang","submitted_at":"2025-05-29T17:59:39Z","abstract_excerpt":"Theorem proving serves as a major testbed for evaluating complex reasoning abilities in large language models (LLMs). However, traditional automated theorem proving (ATP) approaches rely heavily on formal proof systems that poorly align with LLMs' strength derived from informal, natural language knowledge acquired during pre-training. In this work, we propose DeepTheorem, a comprehensive informal theorem-proving framework exploiting natural language to enhance LLM mathematical reasoning. DeepTheorem includes a large-scale benchmark dataset consisting of 121K high-quality IMO-level informal the"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2505.23754","kind":"arxiv","version":2},"metadata":{"license":"http://creativecommons.org/licenses/by-nc-nd/4.0/","primary_cat":"cs.CL","submitted_at":"2025-05-29T17:59:39Z","cross_cats_sorted":["cs.AI"],"title_canon_sha256":"02976b158f0641c181f30b4b5950b9c83d5b5d753cab5bd79abf0ea8a41439e7","abstract_canon_sha256":"44bd95dac9b3cb8a50cc5aedfe2c14ac0c6bfdc13301a1217b68cbbd6fbf8407"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T11:15:00.921969Z","signature_b64":"h6paMtdXXJ+PVsxlzrrCPwQQp341zpJOwQzCPKyEUbDWnqdqmoOzX9BvQaEPrUuEE1bkJ8agWM8jvseRpQHwDw==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"f3b75022e957f13d40dafc5acd73cab868838f6a6df410546bfe98e2a1959f6f","last_reissued_at":"2026-07-05T11:15:00.921482Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T11:15:00.921482Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"DeepTheorem: Advancing LLM Reasoning for Theorem Proving Through Natural Language and Reinforcement Learning","license":"http://creativecommons.org/licenses/by-nc-nd/4.0/","headline":"","cross_cats":["cs.AI"],"primary_cat":"cs.CL","authors_text":"Dong Yu, Haitao Mi, Jiahao Xu, Linfeng Song, Qiuzhi Liu, Rui Wang, Tian Liang, Yansi Li, Zhaopeng Tu, Zhenwen Liang, Zhiwei He, Zhuosheng Zhang, Ziyin Zhang","submitted_at":"2025-05-29T17:59:39Z","abstract_excerpt":"Theorem proving serves as a major testbed for evaluating complex reasoning abilities in large language models (LLMs). However, traditional automated theorem proving (ATP) approaches rely heavily on formal proof systems that poorly align with LLMs' strength derived from informal, natural language knowledge acquired during pre-training. In this work, we propose DeepTheorem, a comprehensive informal theorem-proving framework exploiting natural language to enhance LLM mathematical reasoning. DeepTheorem includes a large-scale benchmark dataset consisting of 121K high-quality IMO-level informal the"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2505.23754","kind":"arxiv","version":2},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2505.23754/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2505.23754","created_at":"2026-07-05T11:15:00.921541+00:00"},{"alias_kind":"arxiv_version","alias_value":"2505.23754v2","created_at":"2026-07-05T11:15:00.921541+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2505.23754","created_at":"2026-07-05T11:15:00.921541+00:00"},{"alias_kind":"pith_short_12","alias_value":"6O3VAIXJK7YT","created_at":"2026-07-05T11:15:00.921541+00:00"},{"alias_kind":"pith_short_16","alias_value":"6O3VAIXJK7YT2QG2","created_at":"2026-07-05T11:15:00.921541+00:00"},{"alias_kind":"pith_short_8","alias_value":"6O3VAIXJ","created_at":"2026-07-05T11:15:00.921541+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":4,"internal_anchor_count":1,"sample":[{"citing_arxiv_id":"2607.07779","citing_title":"From Solvers to Research: Large Language Model-Driven Formal Mathematics at the Research Frontier","ref_index":299,"is_internal_anchor":true},{"citing_arxiv_id":"2606.08728","citing_title":"Artificial Intelligence for Mathematical Reasoning: An Integrated Survey of Language Models, Neuro-symbolic Systems, and Verified Discovery","ref_index":201,"is_internal_anchor":false},{"citing_arxiv_id":"2604.23712","citing_title":"OptProver: Bridging Olympiad and Optimization through Continual Training in Formal Theorem Proving","ref_index":34,"is_internal_anchor":false},{"citing_arxiv_id":"2604.16278","citing_title":"Learning to Reason with Insight for Informal Theorem Proving","ref_index":2,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/6O3VAIXJK7YT2QG27RNM246KXB","json":"https://pith.science/pith/6O3VAIXJK7YT2QG27RNM246KXB.json","graph_json":"https://pith.science/api/pith-number/6O3VAIXJK7YT2QG27RNM246KXB/graph.json","events_json":"https://pith.science/api/pith-number/6O3VAIXJK7YT2QG27RNM246KXB/events.json","paper":"https://pith.science/paper/6O3VAIXJ"},"agent_actions":{"view_html":"https://pith.science/pith/6O3VAIXJK7YT2QG27RNM246KXB","download_json":"https://pith.science/pith/6O3VAIXJK7YT2QG27RNM246KXB.json","view_paper":"https://pith.science/paper/6O3VAIXJ","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2505.23754&json=true","fetch_graph":"https://pith.science/api/pith-number/6O3VAIXJK7YT2QG27RNM246KXB/graph.json","fetch_events":"https://pith.science/api/pith-number/6O3VAIXJK7YT2QG27RNM246KXB/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/6O3VAIXJK7YT2QG27RNM246KXB/action/timestamp_anchor","attest_storage":"https://pith.science/pith/6O3VAIXJK7YT2QG27RNM246KXB/action/storage_attestation","attest_author":"https://pith.science/pith/6O3VAIXJK7YT2QG27RNM246KXB/action/author_attestation","sign_citation":"https://pith.science/pith/6O3VAIXJK7YT2QG27RNM246KXB/action/citation_signature","submit_replication":"https://pith.science/pith/6O3VAIXJK7YT2QG27RNM246KXB/action/replication_record"}},"created_at":"2026-07-05T11:15:00.921541+00:00","updated_at":"2026-07-05T11:15:00.921541+00:00"}