{"as_of":"2026-08-09T18:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4cf0625041c999d8ec397a0fdd2c0b0510ac799e863793d642fef437973fc5fe","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:18:47.624439Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T13:47:38.347594Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T18:17:33.679581Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.08649","snapshot_observed_at":"2026-08-06T13:47:38.347594Z","title":"messages","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.20199","last_updated":"2025-08-13T10:58:50Z","snapshot_observed_at":"2026-08-07T10:10:33.604674Z","submitted_at":"2025-07-27T09:38:32Z","title":"StepFun-Prover Preview: Let's Think and Verify Step by Step","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:38.347594Z"},"links":{"cited_paper":"/paper/2507.08649","citing_paper":"/paper/2507.20199"},"observation_digest":"sha256:9ba270bb30c237fe627f511048a0472522a72f19016b13bb8d3d72d4b0acfe59","observation_id":"2bb83f21-39cd-4c7e-91f2-86b8a9bdbb99","resolution":{"observed_at":"2026-08-06T13:47:38.347594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2507.08649","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.08649","snapshot_observed_at":"2026-07-10T18:17:33.679581Z","title":"arXiv preprint arXiv:2507.08649 , year=","venue":"cs.AI","work_id":"17d5f8ea-985a-4a34-898a-911d4d6fe5ee","year":2025},"citing_paper":{"arxiv_id":"2509.08827","last_updated":"2025-10-09T17:08:52Z","snapshot_observed_at":"2026-08-06T15:38:05.011922Z","submitted_at":"2025-09-10T17:59:43Z","title":"A Survey of Reinforcement Learning for Large Reasoning Models","version":3},"reference_index":232,"source":"arxiv_source","source_observed_at":"2026-05-18T00:02:24.352947Z"},"links":{"cited_paper":"/paper/2507.08649","citing_paper":"/paper/2509.08827"},"observation_digest":"sha256:f6a1315e3584c5297bef1aba28b78de22c07c23a073513aad31efec3e6fe0d63","observation_id":"682088a7-c9ed-4ca8-83e3-b9c9a41bf148","resolution":{"observed_at":"2026-05-18T00:02:24.529672Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2507.08649","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.08649","snapshot_observed_at":"2026-07-10T18:17:33.679581Z","title":"arXiv preprint arXiv:2507.08649 , year=","venue":"cs.AI","work_id":"17d5f8ea-985a-4a34-898a-911d4d6fe5ee","year":2025},"citing_paper":{"arxiv_id":"2604.16995","last_updated":"2026-04-18T13:49:47Z","snapshot_observed_at":"2026-07-06T23:04:10.324443Z","submitted_at":"2026-04-18T13:49:47Z","title":"SPS: Steering Probability Squeezing for Better Exploration in Reinforcement Learning for Large Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-10T06:57:03.100519Z"},"links":{"cited_paper":"/paper/2507.08649","citing_paper":"/paper/2604.16995"},"observation_digest":"sha256:c310b709140e9bdadba2de1a3f7269772403ee5515c27c6b9f193d99248e80a6","observation_id":"828fdfcf-0e14-4045-a842-0079075aadc5","resolution":{"observed_at":"2026-05-10T07:01:49.441454Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2507.08649","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.08649","snapshot_observed_at":"2026-07-10T18:17:33.679581Z","title":"arXiv preprint arXiv:2507.08649 , year=","venue":"cs.AI","work_id":"17d5f8ea-985a-4a34-898a-911d4d6fe5ee","year":2025},"citing_paper":{"arxiv_id":"2605.17283","last_updated":"2026-05-17T06:39:05Z","snapshot_observed_at":"2026-08-08T15:14:20.631028Z","submitted_at":"2026-05-17T06:39:05Z","title":"OProver: A Unified Framework for Agentic Formal Theorem Proving","version":1},"reference_index":159,"source":"arxiv_source","source_observed_at":"2026-05-20T14:43:46.517807Z"},"links":{"cited_paper":"/paper/2507.08649","citing_paper":"/paper/2605.17283"},"observation_digest":"sha256:f344d703f79268d23ccaea490887aa61e080ac45ec2230e3f8144a180d2599fa","observation_id":"5875151c-41de-4e35-9da8-b0e62ea601f3","resolution":{"observed_at":"2026-05-20T14:48:23.501056Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2507.08649","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.08649","snapshot_observed_at":"2026-07-10T18:17:33.679581Z","title":"arXiv preprint arXiv:2507.08649 , year=","venue":"cs.AI","work_id":"17d5f8ea-985a-4a34-898a-911d4d6fe5ee","year":2025},"citing_paper":{"arxiv_id":"2606.31134","last_updated":"2026-08-05T20:38:33Z","snapshot_observed_at":"2026-08-09T18:09:51.519082Z","submitted_at":"2026-06-30T05:05:03Z","title":"Beyond the Library: An Agentic Framework for Autoformalizing Research Mathematics","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-01T05:54:51.200436Z"},"links":{"cited_paper":"/paper/2507.08649","citing_paper":"/paper/2606.31134"},"observation_digest":"sha256:593c99a6e30801eb012a33e83a6c4fb14ee8f361e8aa125e2ee8543e1ac217cc","observation_id":"6a7d7bfc-9620-497f-916a-01d0fb3fc1e1","resolution":{"observed_at":"2026-07-01T10:05:40.800454Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2507.08649","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.08649","snapshot_observed_at":"2026-07-10T18:17:33.679581Z","title":"arXiv preprint arXiv:2507.08649 , year=","venue":"cs.AI","work_id":"17d5f8ea-985a-4a34-898a-911d4d6fe5ee","year":2025},"citing_paper":{"arxiv_id":"2606.31134","last_updated":"2026-08-05T20:38:33Z","snapshot_observed_at":"2026-08-09T18:09:51.519082Z","submitted_at":"2026-06-30T05:05:03Z","title":"Beyond the Library: An Agentic Framework for Autoformalizing Research Mathematics","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-03T22:34:08.241014Z"},"links":{"cited_paper":"/paper/2507.08649","citing_paper":"/paper/2606.31134"},"observation_digest":"sha256:dbee5e55bf01e9854ee45b5e8447145b2a3e684dc9bbffb9b242d116456490ab","observation_id":"cb458ada-d414-4d9b-8f2b-3c905f318061","resolution":{"observed_at":"2026-07-03T22:39:01.189699Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2507.08649","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.08649","snapshot_observed_at":"2026-07-10T18:17:33.679581Z","title":"arXiv preprint arXiv:2507.08649 , year=","venue":"cs.AI","work_id":"17d5f8ea-985a-4a34-898a-911d4d6fe5ee","year":2025},"citing_paper":{"arxiv_id":"2607.07779","last_updated":"2026-07-08T17:46:36Z","snapshot_observed_at":"2026-07-12T23:17:59.879344Z","submitted_at":"2026-07-08T17:46:36Z","title":"From Solvers to Research: Large Language Model-Driven Formal Mathematics at the Research Frontier","version":1},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-07-10T18:16:31.176239Z"},"links":{"cited_paper":"/paper/2507.08649","citing_paper":"/paper/2607.07779"},"observation_digest":"sha256:98853fb2d4bf3871f63525bdda7d87decdf5d63982f14f74e284be3343d63725","observation_id":"c94943b8-12fa-401e-a069-6d27c246ba6e","resolution":{"observed_at":"2026-07-10T18:17:33.680781Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.08649/citation-record","integrity":"/paper/2507.08649/integrity","json":"/paper/2507.08649/citation-record.json","paper":"/paper/2507.08649"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:18:51.854717Z","title":"Claude 3.7 Sonnet System card","venue":null,"work_id":"72d70a92-4a04-450d-9e64-eac78f421498","year":2025},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:43.475730Z"},"links":{"citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:f1aab2942d6e7e3960ca634ea8cca70b292d7f46eee73e48bafc44fffec4b9d5","observation_id":"9da00c7b-e390-46b2-869c-0643f40edb61","resolution":{"observed_at":"2026-08-06T18:18:51.905951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12433","last_updated":"2023-02-24T03:28:46Z","snapshot_observed_at":"2026-08-08T08:53:38.852270Z","submitted_at":"2023-02-24T03:28:46Z","title":"ProofNet: Autoformalizing and Formally Proving Undergraduate-Level Mathematics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12433","snapshot_observed_at":"2026-08-06T18:18:43.564912Z","title":"Azerbayev, B","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:43.564912Z"},"links":{"cited_paper":"/paper/2302.12433","citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:829dce0490fbee440fb42fda723748935d3f0e58bb5962b169d24533f87333a3","observation_id":"20a324a9-e495-41d1-af9d-95e4181b2047","resolution":{"observed_at":"2026-08-06T18:18:43.564912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.01062","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:18:48.586340Z","title":null,"venue":null,"work_id":"af29bf41-4033-4b69-b936-44403ec7530d","year":2025},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:43.687525Z"},"links":{"citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:8bb740eaa0ed170e6366fa36d169eb0ea2b8cd3425a1ca5c0eb09f79e415fcaf","observation_id":"aff0834e-eb48-4759-9338-c8d459a950c1","resolution":{"observed_at":"2026-08-06T18:18:48.641720Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:18:51.676775Z","title":"Bhattacharya, S","venue":null,"work_id":"516c2b33-2c2d-47d6-a69d-2ae8e52b1eb1","year":2020},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:43.797559Z"},"links":{"citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:f0274966737b01c9848fba931b8aafc002eea363ca1797375a446798013bee29","observation_id":"96d9a353-9873-48e2-9531-a55aac44659a","resolution":{"observed_at":"2026-08-06T18:18:51.761824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:18:51.531250Z","title":null,"venue":null,"work_id":"52909622-8b66-4145-b4aa-85432bb7d9e6","year":1996},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:43.907385Z"},"links":{"citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:6ad07656c2df70a75639581e78bf696f3c86be1afad0883a03cc39d9da779283","observation_id":"e82ae746-78f1-478a-9e3a-ab0ef9253704","resolution":{"observed_at":"2026-08-06T18:18:51.609124Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:18:51.363052Z","title":"De Moura, S","venue":null,"work_id":"a1802f4e-9e3e-4b4e-b582-7a1a5879fcc6","year":2015},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:43.986880Z"},"links":{"citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:b19ae3cf1254de585c6938f0f3dd0382e4268ae2248ec9aa5a1fc0801ae5e922","observation_id":"b6332bbf-b849-44a6-8117-48fdc7a00d45","resolution":{"observed_at":"2026-08-06T18:18:51.427529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13542","last_updated":"2024-07-18T09:00:23Z","snapshot_observed_at":"2026-08-03T22:34:13.223301Z","submitted_at":"2024-06-19T13:29:53Z","title":"Self-play with Execution Feedback: Improving Instruction-following Capabilities of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13542","snapshot_observed_at":"2026-08-06T18:18:44.167318Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:44.167318Z"},"links":{"cited_paper":"/paper/2406.13542","citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:b94b4a3c8c5324239ac0be855fe95d14dd7ae4a56988b927cb233abce189a822","observation_id":"5b572fb0-bd20-4b6d-a51e-5b35b5a37116","resolution":{"observed_at":"2026-08-06T18:18:44.167318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00212","last_updated":"2025-03-21T03:27:55Z","snapshot_observed_at":"2026-07-06T20:29:21.568793Z","submitted_at":"2025-01-31T23:01:48Z","title":"STP: Self-play LLM Theorem Provers with Iterative Conjecturing and Proving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00212","snapshot_observed_at":"2026-08-06T18:18:44.264374Z","title":"Dong and T","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:44.264374Z"},"links":{"cited_paper":"/paper/2502.00212","citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:9b24b068c638aff224ff4bc7162c938ea61e41d8275703171359cc078689eea2","observation_id":"c096c8f9-4e54-4d66-9749-2cdf66e2615c","resolution":{"observed_at":"2026-08-06T18:18:44.264374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11536","last_updated":"2025-04-17T16:46:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-15T18:10:22Z","title":"ReTool: Reinforcement Learning for Strategic Tool Use in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11536","snapshot_observed_at":"2026-08-06T18:18:44.404732Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:44.404732Z"},"links":{"cited_paper":"/paper/2504.11536","citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:a3ebac4e2904c646c4ea4be0177936ea1a60fcbbd90540e135d17ac40aec530f","observation_id":"e456820c-203a-4b81-9fea-0697a261aa48","resolution":{"observed_at":"2026-08-06T18:18:44.404732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T18:18:44.525643Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:44.525643Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:f87057a8c9b1184b43ecb4e9ec50f15a366e03c2e717bbc21dcbdef613c3ccf3","observation_id":"a5a53366-a544-4402-9ebe-40eeabae5b6b","resolution":{"observed_at":"2026-08-06T18:18:44.525643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:18:51.220057Z","title":"Huth and M","venue":null,"work_id":"1b4165c0-9c01-463e-b472-b07bc0bbb873","year":2004},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:44.682660Z"},"links":{"citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:3019352be83c8b08c995df14b8fd2cf5615b150917fa233e0c407dd3b8a5d3c2","observation_id":"2160346a-75c4-49d6-bbeb-9ba8b557f89e","resolution":{"observed_at":"2026-08-06T18:18:51.272734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09516","last_updated":"2025-08-05T19:08:38Z","snapshot_observed_at":"2026-07-06T20:51:28.022519Z","submitted_at":"2025-03-12T16:26:39Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09516","snapshot_observed_at":"2026-08-06T18:18:44.807388Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:44.807388Z"},"links":{"cited_paper":"/paper/2503.09516","citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:f4bab613658a8c727ceb463eb87d5fc803e9cc4f50754c7514cb191841865f15","observation_id":"f8bb39d3-01cb-471d-b7fb-9010db4f44df","resolution":{"observed_at":"2026-08-06T18:18:44.807388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:18:51.038256Z","title":null,"venue":null,"work_id":"98247ad2-d6b3-4b32-911e-ded2634ed5c0","year":2024},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:44.946016Z"},"links":{"citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:ea6e11c05eed53e086212e8a06a96835622cd8832747746beb4e56f656b98c80","observation_id":"765e0b63-2e6c-4a96-bef7-3e1baf5f7b52","resolution":{"observed_at":"2026-08-06T18:18:51.145007Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07640","last_updated":"2025-04-19T13:53:05Z","snapshot_observed_at":"2026-08-08T12:00:22.357251Z","submitted_at":"2025-02-11T15:27:35Z","title":"Goedel-Prover: A Frontier Model for Open-Source Automated Theorem Proving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07640","snapshot_observed_at":"2026-08-06T18:18:45.103299Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:45.103299Z"},"links":{"cited_paper":"/paper/2502.07640","citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:160d1733d0418f81b11a7d8ed4d5447d6157ddb225148c45c768ea1211e4f24e","observation_id":"3d634a62-ffdc-4b6f-a1e5-cadebc78705f","resolution":{"observed_at":"2026-08-06T18:18:45.103299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:18:50.841330Z","title":null,"venue":null,"work_id":"5fbe8400-e689-415c-adf5-32b02149fcde","year":2021},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:45.177957Z"},"links":{"citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:81a3491eb8cbbdceb2323eeb609702a0a04de94b42e6f7bd13cedc00a1dc2aa5","observation_id":"caa682cb-c41d-4857-8483-8ddd1fe1a2a2","resolution":{"observed_at":"2026-08-06T18:18:50.947450Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:18:50.568558Z","title":"Nipkow, M","venue":null,"work_id":"8648a1ac-2e6f-4157-abe4-ff2cdef2aad2","year":2002},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:45.284724Z"},"links":{"citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:489b505ec8af0fae8c24b7817ffcb64d3581f32d776e755202db9c98f9ef7c5d","observation_id":"20111498-2f62-4ef8-b099-03ec6e16b911","resolution":{"observed_at":"2026-08-06T18:18:50.679840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12255","last_updated":"2022-05-24T17:58:13Z","snapshot_observed_at":"2026-08-07T07:09:50.694532Z","submitted_at":"2022-05-24T17:58:13Z","title":"TALM: Tool Augmented Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12255","snapshot_observed_at":"2026-08-06T18:18:45.363604Z","title":"Parisi, Y","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:45.363604Z"},"links":{"cited_paper":"/paper/2205.12255","citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:21e55f9276bdefddd7168cb1ff0b0659cb9a18659d98b9a68b45c5b2013e3c33","observation_id":"e5a4b664-32be-4d84-9eb1-fc049f80ff19","resolution":{"observed_at":"2026-08-06T18:18:45.363604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:18:50.250058Z","title":null,"venue":null,"work_id":"53d493d8-3221-4cd4-9954-659f32950661","year":2024},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:45.444653Z"},"links":{"citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:71872316d137fa49bf40fd705c52a87ae35c3e47e125159017eaa6d26ac0ced1","observation_id":"94f667c7-1007-4a57-a38c-b9679e83d72b","resolution":{"observed_at":"2026-08-06T18:18:50.384899Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13958","last_updated":"2025-04-16T21:45:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-16T21:45:32Z","title":"ToolRL: Reward is All Tool Learning Needs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13958","snapshot_observed_at":"2026-08-06T18:18:45.525815Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:45.525815Z"},"links":{"cited_paper":"/paper/2504.13958","citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:7648197b1a6163546d87de398e972ca908f57048b1f7a16675a6384e537b01a5","observation_id":"722f5792-a9db-4857-9d02-35696cd171af","resolution":{"observed_at":"2026-08-06T18:18:45.525815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21801","last_updated":"2025-07-18T08:20:23Z","snapshot_observed_at":"2026-08-02T11:46:58.603316Z","submitted_at":"2025-04-30T16:57:48Z","title":"DeepSeek-Prover-V2: Advancing Formal Mathematical Reasoning via Reinforcement Learning for Subgoal Decomposition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21801","snapshot_observed_at":"2026-08-06T18:18:45.628122Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:45.628122Z"},"links":{"cited_paper":"/paper/2504.21801","citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:aebf78c0e3c86978d82b066e2f1fdbf072d2a4db9e12dce7a767045ee6175e6d","observation_id":"9352693f-2c72-4ee8-ad15-cd9e9659b92e","resolution":{"observed_at":"2026-08-06T18:18:45.628122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:18:50.022390Z","title":"Schick, J","venue":null,"work_id":"a5360ae3-3937-49dc-8f70-a618906ef300","year":2023},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:45.715535Z"},"links":{"citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:6885720b3305cb6d5ae36a44249b7e4d7bff27f093240fd4be22a7bd297fbff5","observation_id":"15ea4479-67e0-4db3-8bc3-7e15843987a1","resolution":{"observed_at":"2026-08-06T18:18:50.118777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-06T18:18:45.803334Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:45.803334Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:7c827ca74264c8a346814b81b289053a533b86efa5b2de9c51faa6d15f2e38e7","observation_id":"6b3123d5-8196-4958-823e-d1c763d7da42","resolution":{"observed_at":"2026-08-06T18:18:45.803334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:18:49.699993Z","title":"Shinn, F","venue":null,"work_id":"a7bd53b7-54d4-4e8f-94d0-48fa4c163355","year":2023},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:45.928953Z"},"links":{"citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:fa071ccfc1170cf28ee88e5efe9aceb3b3802921132502769d7f375d6f930243","observation_id":"4b92cf82-583c-4d41-b144-c1f2d3811c1d","resolution":{"observed_at":"2026-08-06T18:18:49.839487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05592","last_updated":"2025-03-18T08:32:24Z","snapshot_observed_at":"2026-08-09T05:07:17.305244Z","submitted_at":"2025-03-07T17:14:44Z","title":"R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05592","snapshot_observed_at":"2026-08-06T18:18:46.027609Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:46.027609Z"},"links":{"cited_paper":"/paper/2503.05592","citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:0f4f1c44a55bc5fa898f75c0b81d1b1f424e628ee82a72de3568f314cada6060","observation_id":"43da433e-e2a3-4409-99b6-9cef1b844190","resolution":{"observed_at":"2026-08-06T18:18:46.027609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-06T18:18:46.106656Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:46.106656Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:77cc4d97744932453a7b904ccab393a70cdab17a3aaf1b51bd5d43f40fb21876","observation_id":"19215c41-aeec-45df-92e7-b6b81626a5bb","resolution":{"observed_at":"2026-08-06T18:18:46.106656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:18:49.362822Z","title":null,"venue":null,"work_id":"7eeb4f5c-2200-45c9-8bee-369dc61df83d","year":2024},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:46.182318Z"},"links":{"citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:dab38ba50caf8b5f65f200cd5e6068ab22042339a054e6e4fa662a3d9e95e373","observation_id":"ece6de65-fbe4-482c-ac8e-88b0f346020c","resolution":{"observed_at":"2026-08-06T18:18:49.536643Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:18:49.059452Z","title":null,"venue":null,"work_id":"6bf55ba8-151c-4eba-86f2-b327f4dde236","year":2025},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:46.345511Z"},"links":{"citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:73b5197cfde3c4dc010f3e9ffca6fa54f281365d79714cd9d50e3dd6b0a2587f","observation_id":"c3375fab-580b-47a1-8ccd-54f0ce36b4a1","resolution":{"observed_at":"2026-08-06T18:18:49.206497Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11214","last_updated":"2024-11-03T17:14:37Z","snapshot_observed_at":"2026-08-08T18:18:53.692980Z","submitted_at":"2024-07-15T19:57:15Z","title":"PutnamBench: Evaluating Neural Theorem-Provers on the Putnam Mathematical Competition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11214","snapshot_observed_at":"2026-08-06T18:18:46.473010Z","title":"Tsoukalas, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:46.473010Z"},"links":{"cited_paper":"/paper/2407.11214","citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:672c05b50bf908056c5106b0d21b87596e9fad6faa4816cddfe341d34b897c21","observation_id":"338f8433-643c-49dc-8de2-86666a1c4b02","resolution":{"observed_at":"2026-08-06T18:18:46.473010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14870","last_updated":"2025-05-31T20:08:42Z","snapshot_observed_at":"2026-08-08T02:02:02.959157Z","submitted_at":"2025-04-21T05:40:05Z","title":"Acting Less is Reasoning More! Teaching Model to Act Efficiently","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14870","snapshot_observed_at":"2026-08-06T18:18:46.554317Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:46.554317Z"},"links":{"cited_paper":"/paper/2504.14870","citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:a6163f75b828c62a8e3bbfb14d80fe1bff667bd52a7f9cecb44a2c2956ccf6e9","observation_id":"86cfd31f-1a67-480e-ac4d-db714264189b","resolution":{"observed_at":"2026-08-06T18:18:46.554317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11354","last_updated":"2025-04-15T16:23:44Z","snapshot_observed_at":"2026-08-03T03:38:06.953412Z","submitted_at":"2025-04-15T16:23:44Z","title":"Kimina-Prover Preview: Towards Large Formal Reasoning Models with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11354","snapshot_observed_at":"2026-08-06T18:18:46.662900Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:46.662900Z"},"links":{"cited_paper":"/paper/2504.11354","citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:3735e17dbc0ead9255c66742e6f9ed1c9a823d22721c15a1144f8b29324b5e96","observation_id":"25be5431-a527-44b5-b58b-69d5bb68dc97","resolution":{"observed_at":"2026-08-06T18:18:46.662900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03203","last_updated":"2024-10-04T03:06:26Z","snapshot_observed_at":"2026-08-08T23:59:01.170425Z","submitted_at":"2024-07-03T15:36:18Z","title":"TheoremLlama: Transforming General-Purpose LLMs into Lean4 Experts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03203","snapshot_observed_at":"2026-08-06T18:18:46.739466Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:46.739466Z"},"links":{"cited_paper":"/paper/2407.03203","citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:3a6a0ba3da25cc68b86badc54c054f356b5cc6fc6cbddd78d07e425aeef07195","observation_id":"adffd939-c8d1-422e-a2e8-9f5f307a83cf","resolution":{"observed_at":"2026-08-06T18:18:46.739466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14333","last_updated":"2024-05-23T09:03:42Z","snapshot_observed_at":"2026-07-06T18:18:25.746022Z","submitted_at":"2024-05-23T09:03:42Z","title":"DeepSeek-Prover: Advancing Theorem Proving in LLMs through Large-Scale Synthetic Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14333","snapshot_observed_at":"2026-08-06T18:18:46.876379Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:46.876379Z"},"links":{"cited_paper":"/paper/2405.14333","citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:91d8edc2244dac5090b732c7fc9550724236cac8d7ce29a424d5fb3f9c7c00a6","observation_id":"4da8b8bf-4e28-4aab-a4d5-66ad40c90ff5","resolution":{"observed_at":"2026-08-06T18:18:46.876379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08152","last_updated":"2024-08-15T13:40:03Z","snapshot_observed_at":"2026-07-06T19:01:06.124684Z","submitted_at":"2024-08-15T13:40:03Z","title":"DeepSeek-Prover-V1.5: Harnessing Proof Assistant Feedback for Reinforcement Learning and Monte-Carlo Tree Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08152","snapshot_observed_at":"2026-08-06T18:18:46.956668Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:46.956668Z"},"links":{"cited_paper":"/paper/2408.08152","citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:9bba59a47a0b8fa91d05efa9499162c5c157b174d5ed6f2ef7d9054ffe54769e","observation_id":"b592f4b3-63e6-4fdf-8045-4b2ed7246c7a","resolution":{"observed_at":"2026-08-06T18:18:46.956668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13818","last_updated":"2026-04-22T00:26:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-18T17:49:55Z","title":"Not All Rollouts are Useful: Down-Sampling Rollouts in LLM Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13818","snapshot_observed_at":"2026-08-06T18:18:47.052766Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:47.052766Z"},"links":{"cited_paper":"/paper/2504.13818","citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:8b7a01496a71f7e67c0f7a61406d0ad62f5319bdc62d8852246056188917e1b6","observation_id":"5d96a391-30ca-488a-8aaa-fbfd5ef3c156","resolution":{"observed_at":"2026-08-06T18:18:47.052766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:18:48.777537Z","title":null,"venue":null,"work_id":"306ba5f5-f6ed-405b-b616-ada9cfb9a1d4","year":2023},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:47.165934Z"},"links":{"citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:cab1dce773e241bd22be74f2c05067db7a39336eb2cf0a1bdc80b93d826eb4ba","observation_id":"52eed9b6-732a-439f-b860-10c57a45f2b6","resolution":{"observed_at":"2026-08-06T18:18:48.910451Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-06T18:18:47.322737Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:47.322737Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:4b81aa0dfbc34d6589688f1a39d68651fe607da9f093dafce3745620c3bc5bc4","observation_id":"487bdc8d-986c-43ba-ae65-873f8708f288","resolution":{"observed_at":"2026-08-06T18:18:47.322737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.06122","last_updated":"2025-07-14T04:41:15Z","snapshot_observed_at":"2026-08-07T16:07:28.977536Z","submitted_at":"2025-04-08T15:15:26Z","title":"Leanabell-Prover: Posttraining Scaling in Formal Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.06122","snapshot_observed_at":"2026-08-06T18:18:47.417844Z","title":"Zhang, Q","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:47.417844Z"},"links":{"cited_paper":"/paper/2504.06122","citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:12cafe274b9c9c53fc4a8699d4ef06d7016d782c086583e03f95209b63cc8a8f","observation_id":"c07fa38a-ca19-4c64-aaf3-e83b154b0612","resolution":{"observed_at":"2026-08-06T18:18:47.417844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.00110","last_updated":"2022-02-28T06:03:23Z","snapshot_observed_at":"2026-08-09T06:26:57.793642Z","submitted_at":"2021-08-31T23:21:12Z","title":"MiniF2F: a cross-system benchmark for formal Olympiad-level mathematics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.00110","snapshot_observed_at":"2026-08-06T18:18:47.509119Z","title":"Zheng, J","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:47.509119Z"},"links":{"cited_paper":"/paper/2109.00110","citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:48018f39318b0c404df9f9b13b579b39d2044e15d082941d0aba3f9f703372c0","observation_id":"0dcf0989-a153-47d8-a1f5-78eb5a354fec","resolution":{"observed_at":"2026-08-06T18:18:47.509119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03363","last_updated":"2024-06-05T15:18:08Z","snapshot_observed_at":"2026-08-01T08:36:35.398469Z","submitted_at":"2024-06-05T15:18:08Z","title":"LLM-based Rewriting of Inappropriate Argumentation using Reinforcement Learning from Machine Feedback","version":1},"cited_work":{"arxiv_id":"2406.03363","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.03363","snapshot_observed_at":"2026-08-06T18:18:47.730105Z","title":"LLM-based Rewriting of Inappropriate Argumentation using Reinforcement Learning from Machine Feedback","venue":"cs.CL","work_id":"38adf90b-1988-4d57-b5c5-94ac71065d1c","year":2024},"citing_paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:47.624439Z"},"links":{"cited_paper":"/paper/2406.03363","citing_paper":"/paper/2507.08649"},"observation_digest":"sha256:132a008ea886bde4dff41d339bce49a4e9a4fd502b763d2613e92a420281cf8a","observation_id":"39a2b503-0ab0-408d-b33d-99646b1bba31","resolution":{"observed_at":"2026-08-06T18:18:47.802255Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.08649","last_updated":"2025-07-11T14:53:14Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-08T00:43:04.480024Z","submitted_at":"2025-07-11T14:53:14Z","title":"Leanabell-Prover-V2: Verifier-integrated Reasoning for Formal Theorem Proving via Reinforcement Learning"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":2,"verified_fuzzy":7},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 7 inbound Pith citation observations for arXiv:2507.08649."}