{"as_of":"2026-08-14T08:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f30cd375f732ab843925e60dde1b47ac7cd1d96f794948371de62db618c38cbd","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T13:37:32.560955Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T21:18:03.059645Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T20:47:34.576528Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.26076","last_updated":"2026-07-09T16:12:00Z","snapshot_observed_at":"2026-08-13T10:50:16.008833Z","submitted_at":"2025-09-30T10:50:37Z","title":"IMProofBench: Benchmarking AI on Research-Level Mathematical Proof Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.26076","snapshot_observed_at":"2026-08-02T21:18:03.059645Z","title":"S., Sun, Z., Teichmann, J., Thomas, R","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.20629","last_updated":"2026-07-06T08:57:26Z","snapshot_observed_at":"2026-08-14T05:01:11.747853Z","submitted_at":"2026-02-24T07:23:28Z","title":"QEDBENCH: Quantifying the Alignment Gap in Automated Evaluation of University-Level Mathematical Proofs","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-02T21:18:03.059645Z"},"links":{"cited_paper":"/paper/2509.26076","citing_paper":"/paper/2602.20629"},"observation_digest":"sha256:ab6f76f08e500106eb35989159b3b1df8f8db0c8235a486a3c3ab63f0f51c737","observation_id":"1f8abaf7-22a3-46b4-8828-108f2c723af3","resolution":{"observed_at":"2026-08-02T21:18:03.059645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.26076","last_updated":"2026-07-09T16:12:00Z","snapshot_observed_at":"2026-08-13T10:50:16.008833Z","submitted_at":"2025-09-30T10:50:37Z","title":"IMProofBench: Benchmarking AI on Research-Level Mathematical Proof Generation","version":2},"cited_work":{"arxiv_id":"2509.26076","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.26076","snapshot_observed_at":"2026-07-10T20:47:34.576528Z","title":"Thomas, and Charles Vial","venue":"cs.CL","work_id":"7313e180-f76c-42c5-b960-70b1f0d0ac40","year":2025},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-08-12T15:04:24.189561Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-12T01:53:12.708706Z"},"links":{"cited_paper":"/paper/2509.26076","citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:2b63f6711141e38d8a7134867eecd56f9f32d2ddeab5e22e849b16e59c8b6fa3","observation_id":"d7557716-135e-44c1-8d77-199091052b5e","resolution":{"observed_at":"2026-07-10T02:19:32.479333Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.26076","last_updated":"2026-07-09T16:12:00Z","snapshot_observed_at":"2026-08-13T10:50:16.008833Z","submitted_at":"2025-09-30T10:50:37Z","title":"IMProofBench: Benchmarking AI on Research-Level Mathematical Proof Generation","version":2},"cited_work":{"arxiv_id":"2509.26076","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.26076","snapshot_observed_at":"2026-07-10T20:47:34.576528Z","title":"Thomas, and Charles Vial","venue":"cs.CL","work_id":"7313e180-f76c-42c5-b960-70b1f0d0ac40","year":2025},"citing_paper":{"arxiv_id":"2605.09063","last_updated":"2026-05-19T16:12:41Z","snapshot_observed_at":"2026-08-12T15:04:24.189561Z","submitted_at":"2026-05-09T17:14:22Z","title":"Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-20T22:24:04.625823Z"},"links":{"cited_paper":"/paper/2509.26076","citing_paper":"/paper/2605.09063"},"observation_digest":"sha256:9a76a59b4f591b8f8e65897ddeefbf0ffe61d7b36405a7a176af0811c080ca47","observation_id":"f01528dd-f169-4bd6-a94c-d75730cf07d8","resolution":{"observed_at":"2026-07-10T02:19:32.479333Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.26076","last_updated":"2026-07-09T16:12:00Z","snapshot_observed_at":"2026-08-13T10:50:16.008833Z","submitted_at":"2025-09-30T10:50:37Z","title":"IMProofBench: Benchmarking AI on Research-Level Mathematical Proof Generation","version":2},"cited_work":{"arxiv_id":"2509.26076","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.26076","snapshot_observed_at":"2026-07-10T20:47:34.576528Z","title":"Thomas, and Charles Vial","venue":"cs.CL","work_id":"7313e180-f76c-42c5-b960-70b1f0d0ac40","year":2025},"citing_paper":{"arxiv_id":"2605.10379","last_updated":"2026-06-25T12:27:46Z","snapshot_observed_at":"2026-08-12T22:02:49.512509Z","submitted_at":"2026-05-11T11:23:36Z","title":"Not All Proofs Are Equal: Evaluating LLM Proof Quality Beyond Correctness","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-12T04:46:50.177357Z"},"links":{"cited_paper":"/paper/2509.26076","citing_paper":"/paper/2605.10379"},"observation_digest":"sha256:28579f628517df0f1873dae35d8dc0da0076bcfe55345e0bb4f3614ba06ff086","observation_id":"ea917522-b376-4351-a2bc-241d004cb161","resolution":{"observed_at":"2026-07-10T02:19:32.479333Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.26076","last_updated":"2026-07-09T16:12:00Z","snapshot_observed_at":"2026-08-13T10:50:16.008833Z","submitted_at":"2025-09-30T10:50:37Z","title":"IMProofBench: Benchmarking AI on Research-Level Mathematical Proof Generation","version":2},"cited_work":{"arxiv_id":"2509.26076","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.26076","snapshot_observed_at":"2026-07-10T20:47:34.576528Z","title":"Thomas, and Charles Vial","venue":"cs.CL","work_id":"7313e180-f76c-42c5-b960-70b1f0d0ac40","year":2025},"citing_paper":{"arxiv_id":"2605.10379","last_updated":"2026-06-25T12:27:46Z","snapshot_observed_at":"2026-08-12T22:02:49.512509Z","submitted_at":"2026-05-11T11:23:36Z","title":"Not All Proofs Are Equal: Evaluating LLM Proof Quality Beyond Correctness","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T22:38:26.111517Z"},"links":{"cited_paper":"/paper/2509.26076","citing_paper":"/paper/2605.10379"},"observation_digest":"sha256:7e9ecfe5a4aafec58cffdd38272ca0aec3e0e82530e1f3e376c5d18b5ae5c38d","observation_id":"8cad4ab0-97cb-45f3-aafb-bbed3f1ae5b1","resolution":{"observed_at":"2026-07-10T02:19:32.479333Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.26076","last_updated":"2026-07-09T16:12:00Z","snapshot_observed_at":"2026-08-13T10:50:16.008833Z","submitted_at":"2025-09-30T10:50:37Z","title":"IMProofBench: Benchmarking AI on Research-Level Mathematical Proof Generation","version":2},"cited_work":{"arxiv_id":"2509.26076","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.26076","snapshot_observed_at":"2026-07-10T20:47:34.576528Z","title":"Thomas, and Charles Vial","venue":"cs.CL","work_id":"7313e180-f76c-42c5-b960-70b1f0d0ac40","year":2025},"citing_paper":{"arxiv_id":"2606.24902","last_updated":"2026-06-12T14:58:20Z","snapshot_observed_at":"2026-08-13T05:25:23.013920Z","submitted_at":"2026-06-12T14:58:20Z","title":"Failure Modes of Large Language Models on Research-Level Mathematics: A Taxonomy and an Empirical Characterisation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T05:09:33.431246Z"},"links":{"cited_paper":"/paper/2509.26076","citing_paper":"/paper/2606.24902"},"observation_digest":"sha256:d5b52c226e29647e97cdc2299c6dee0b0ac4030eb0a771d6548b8532313b9601","observation_id":"b357d459-e2a5-4e25-a717-66f7bdb4f7cf","resolution":{"observed_at":"2026-07-10T02:19:32.479333Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.26076","last_updated":"2026-07-09T16:12:00Z","snapshot_observed_at":"2026-08-13T10:50:16.008833Z","submitted_at":"2025-09-30T10:50:37Z","title":"IMProofBench: Benchmarking AI on Research-Level Mathematical Proof Generation","version":2},"cited_work":{"arxiv_id":"2509.26076","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.26076","snapshot_observed_at":"2026-07-10T20:47:34.576528Z","title":"Thomas, and Charles Vial","venue":"cs.CL","work_id":"7313e180-f76c-42c5-b960-70b1f0d0ac40","year":2025},"citing_paper":{"arxiv_id":"2607.06820","last_updated":"2026-07-07T21:29:59Z","snapshot_observed_at":"2026-08-13T01:59:45.427747Z","submitted_at":"2026-07-07T21:29:59Z","title":"Evaluating SageMath-Augmented LLM Agents for Computational and Experimental Mathematics","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-10T20:39:42.009312Z"},"links":{"cited_paper":"/paper/2509.26076","citing_paper":"/paper/2607.06820"},"observation_digest":"sha256:57115196d803aad856b403a5ee7ad0cf328ddb6c8a683216e309f1fdae58b6be","observation_id":"1f328be5-23e9-4f65-acc4-f99081908c3c","resolution":{"observed_at":"2026-07-10T20:47:34.577936Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.26076","last_updated":"2026-07-09T16:12:00Z","snapshot_observed_at":"2026-08-13T10:50:16.008833Z","submitted_at":"2025-09-30T10:50:37Z","title":"IMProofBench: Benchmarking AI on Research-Level Mathematical Proof Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.26076","snapshot_observed_at":"2026-08-01T18:16:49.376545Z","title":"Schmitt et al.,IMProofBench: Benchmarking AI on research-level mathematical proof generation,arXiv:2509.26076, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17388","last_updated":"2026-07-19T19:22:40Z","snapshot_observed_at":"2026-08-12T17:03:46.311096Z","submitted_at":"2026-07-19T19:22:40Z","title":"Mathematical Discovery in the Wild: AI-Guided Proofs in Banach Space Theory","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:49.376545Z"},"links":{"cited_paper":"/paper/2509.26076","citing_paper":"/paper/2607.17388"},"observation_digest":"sha256:49aa61c826ccc70b3831fd05b2f076accf042171f2e28ea55b84b7e9ba5b8130","observation_id":"6b684b02-1c91-4de6-8725-708a62daab8b","resolution":{"observed_at":"2026-08-01T18:16:49.376545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.26076/citation-record","integrity":"/paper/2509.26076/integrity","json":"/paper/2509.26076/citation-record.json","paper":"/paper/2509.26076"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:37:32.491188Z","title":"auto\" max tokens=32000 reasoningtokens=31000 GPT-5gpt-5 reasoning effort=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.26076","last_updated":"2026-07-09T16:12:00Z","snapshot_observed_at":"2026-08-13T10:50:16.008833Z","submitted_at":"2025-09-30T10:50:37Z","title":"IMProofBench: Benchmarking AI on Research-Level Mathematical Proof Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T13:37:32.491188Z"},"links":{"citing_paper":"/paper/2509.26076"},"observation_digest":"sha256:b6eae3a64e046570e254a4665da211857afcae030882db6b035dcf0811517943","observation_id":"0a0b2507-5364-45d0-b760-f35a7f8848f4","resolution":{"observed_at":"2026-08-04T13:37:32.491188Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:37:32.486780Z","title":"True”, “False","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.26076","last_updated":"2026-07-09T16:12:00Z","snapshot_observed_at":"2026-08-13T10:50:16.008833Z","submitted_at":"2025-09-30T10:50:37Z","title":"IMProofBench: Benchmarking AI on Research-Level Mathematical Proof Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T13:37:32.486780Z"},"links":{"citing_paper":"/paper/2509.26076"},"observation_digest":"sha256:b1d3bff92838053dfb787fe8f3820f8f1b76c839e17091afc37d004ef15f6f31","observation_id":"859ddf17-b539-4bd9-aaf0-85183824d9cb","resolution":{"observed_at":"2026-08-04T13:37:32.486780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:37:32.527322Z","title":"Underlying system is ArchLinux with many standard open-source computer algebra systems (like GAP) pre-installed","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.26076","last_updated":"2026-07-09T16:12:00Z","snapshot_observed_at":"2026-08-13T10:50:16.008833Z","submitted_at":"2025-09-30T10:50:37Z","title":"IMProofBench: Benchmarking AI on Research-Level Mathematical Proof Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T13:37:32.527322Z"},"links":{"citing_paper":"/paper/2509.26076"},"observation_digest":"sha256:bfba51bf5583d9ce0091a888578961b7ae82cfdfd6535adc324ad289a580a3bf","observation_id":"7c497c22-3734-4a45-91c4-60d6ae89c9cd","resolution":{"observed_at":"2026-08-04T13:37:32.527322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:37:32.531671Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.26076","last_updated":"2026-07-09T16:12:00Z","snapshot_observed_at":"2026-08-13T10:50:16.008833Z","submitted_at":"2025-09-30T10:50:37Z","title":"IMProofBench: Benchmarking AI on Research-Level Mathematical Proof Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T13:37:32.531671Z"},"links":{"citing_paper":"/paper/2509.26076"},"observation_digest":"sha256:bf1719e51d8f7571de79266c6cc1ef53788b8d209e4dfcf0a40010a4138aea2a","observation_id":"1793932a-450d-4f67-8f15-7aec79b04cdf","resolution":{"observed_at":"2026-08-04T13:37:32.531671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:37:32.536767Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.26076","last_updated":"2026-07-09T16:12:00Z","snapshot_observed_at":"2026-08-13T10:50:16.008833Z","submitted_at":"2025-09-30T10:50:37Z","title":"IMProofBench: Benchmarking AI on Research-Level Mathematical Proof Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T13:37:32.536767Z"},"links":{"citing_paper":"/paper/2509.26076"},"observation_digest":"sha256:927826ce13c7baa72a749cb867d5237b579e241bbef092e946e7229076230534","observation_id":"ab2dc781-301c-4951-8797-eb55724f477c","resolution":{"observed_at":"2026-08-04T13:37:32.536767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:37:32.540729Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.26076","last_updated":"2026-07-09T16:12:00Z","snapshot_observed_at":"2026-08-13T10:50:16.008833Z","submitted_at":"2025-09-30T10:50:37Z","title":"IMProofBench: Benchmarking AI on Research-Level Mathematical Proof Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T13:37:32.540729Z"},"links":{"citing_paper":"/paper/2509.26076"},"observation_digest":"sha256:052353a4cc2d298e88c22f88a8da19b13e888f4cf98dfc7de5a6b7e329bbf041","observation_id":"ed45ed3d-7901-4e1b-a2b2-daf658740686","resolution":{"observed_at":"2026-08-04T13:37:32.540729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:37:32.544745Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.26076","last_updated":"2026-07-09T16:12:00Z","snapshot_observed_at":"2026-08-13T10:50:16.008833Z","submitted_at":"2025-09-30T10:50:37Z","title":"IMProofBench: Benchmarking AI on Research-Level Mathematical Proof Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T13:37:32.544745Z"},"links":{"citing_paper":"/paper/2509.26076"},"observation_digest":"sha256:ec245c8dacb47a23621904ab79ce5ba99d1796d2d4af29cf6c630de09d28b907","observation_id":"0b91531d-a425-4294-a01d-215f96e14b7a","resolution":{"observed_at":"2026-08-04T13:37:32.544745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:37:32.548634Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.26076","last_updated":"2026-07-09T16:12:00Z","snapshot_observed_at":"2026-08-13T10:50:16.008833Z","submitted_at":"2025-09-30T10:50:37Z","title":"IMProofBench: Benchmarking AI on Research-Level Mathematical Proof Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T13:37:32.548634Z"},"links":{"citing_paper":"/paper/2509.26076"},"observation_digest":"sha256:5c4b08c86a789a7847e8e3428b469df9491c4113889b1f643982d08e850c2a4c","observation_id":"a13de7cd-8341-4d60-9d74-722221a2b506","resolution":{"observed_at":"2026-08-04T13:37:32.548634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:37:32.553254Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.26076","last_updated":"2026-07-09T16:12:00Z","snapshot_observed_at":"2026-08-13T10:50:16.008833Z","submitted_at":"2025-09-30T10:50:37Z","title":"IMProofBench: Benchmarking AI on Research-Level Mathematical Proof Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T13:37:32.553254Z"},"links":{"citing_paper":"/paper/2509.26076"},"observation_digest":"sha256:c1994322b80d9ba19d7d7e07d77fbe053c71e612a416c7dc01a5739d4e8ea410","observation_id":"c9b8500a-a5ff-4292-ad51-64bca15661ea","resolution":{"observed_at":"2026-08-04T13:37:32.553254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:37:32.557052Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.26076","last_updated":"2026-07-09T16:12:00Z","snapshot_observed_at":"2026-08-13T10:50:16.008833Z","submitted_at":"2025-09-30T10:50:37Z","title":"IMProofBench: Benchmarking AI on Research-Level Mathematical Proof Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T13:37:32.557052Z"},"links":{"citing_paper":"/paper/2509.26076"},"observation_digest":"sha256:dd3e9672a0355cb990be956323071e5a9c9eaca7214a5990636d86c394963018","observation_id":"e86454a3-6f74-44f0-86a9-23feabeadd4b","resolution":{"observed_at":"2026-08-04T13:37:32.557052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:37:32.560955Z","title":"Automorphismsˆ2: {G.automorphism_number()ˆ2}","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.26076","last_updated":"2026-07-09T16:12:00Z","snapshot_observed_at":"2026-08-13T10:50:16.008833Z","submitted_at":"2025-09-30T10:50:37Z","title":"IMProofBench: Benchmarking AI on Research-Level Mathematical Proof Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T13:37:32.560955Z"},"links":{"citing_paper":"/paper/2509.26076"},"observation_digest":"sha256:18aa7e1a720df84c7194285d126918696d81433d8f1168ae6493102e96d274ab","observation_id":"b0bebd92-ee2c-4141-ab8c-a4915d36f924","resolution":{"observed_at":"2026-08-04T13:37:32.560955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23281","last_updated":"2026-01-14T21:39:58Z","snapshot_observed_at":"2026-08-02T10:05:44.330694Z","submitted_at":"2025-05-29T09:28:06Z","title":"MathArena: Evaluating LLMs on Uncontaminated Math Competitions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23281","snapshot_observed_at":"2026-08-04T13:37:32.480041Z","title":"Is the statement true forn= 5 ?","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.26076","last_updated":"2026-07-09T16:12:00Z","snapshot_observed_at":"2026-08-13T10:50:16.008833Z","submitted_at":"2025-09-30T10:50:37Z","title":"IMProofBench: Benchmarking AI on Research-Level Mathematical Proof Generation","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T13:37:32.480041Z"},"links":{"cited_paper":"/paper/2505.23281","citing_paper":"/paper/2509.26076"},"observation_digest":"sha256:323111fa7bb7a27104aa7c9d43e9d5ca1e95714471b6565f460879d86b8e0503","observation_id":"0223ef71-1371-4e6e-be0e-a8e68dc2a275","resolution":{"observed_at":"2026-08-04T13:37:32.480041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.26076","last_updated":"2026-07-09T16:12:00Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T10:50:16.008833Z","submitted_at":"2025-09-30T10:50:37Z","title":"IMProofBench: Benchmarking AI on Research-Level Mathematical Proof Generation"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 8 inbound Pith citation observations for arXiv:2509.26076."}