{"as_of":"2026-08-22T09:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:53deabf3b705bb429af327e4519e88f052559b1b264b006ea9c7c86ef442453b","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T06:56:32.253843Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T17:33:57.657900Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.29493","last_updated":"2026-06-28T16:46:36Z","snapshot_observed_at":"2026-08-18T21:04:46.495934Z","submitted_at":"2026-06-28T16:46:36Z","title":"Faults in Our Formal Benchmarking: Dataset Defects and Evaluation Failures in Lean Theorem Proving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.29493","snapshot_observed_at":"2026-07-31T17:33:57.657900Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28110","last_updated":"2026-07-30T12:17:31Z","snapshot_observed_at":"2026-08-16T05:35:11.391607Z","submitted_at":"2026-07-30T12:17:31Z","title":"BlueprintRepair: Typed Local Edits for Failed Lean Proof Blueprints","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-31T17:33:57.657900Z"},"links":{"cited_paper":"/paper/2606.29493","citing_paper":"/paper/2607.28110"},"observation_digest":"sha256:51beff6476025dbb9a5705f0173c35c48c6c7214ed16be357624844d905180d9","observation_id":"7b639108-f0df-4267-b769-2dab016c3af2","resolution":{"observed_at":"2026-07-31T17:33:57.657900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2606.29493/citation-record","integrity":"/paper/2606.29493/integrity","json":"/paper/2606.29493/citation-record.json","paper":"/paper/2606.29493"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.03171","last_updated":"2025-05-06T04:32:17Z","snapshot_observed_at":"2026-08-18T21:04:01.915215Z","submitted_at":"2025-05-06T04:32:17Z","title":"CombiBench: Benchmarking LLM Capability for Combinatorial Mathematics","version":1},"cited_work":{"arxiv_id":"2505.03171","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.03171","snapshot_observed_at":"2026-07-10T18:17:33.661610Z","title":"Combibench: Benchmarking llm capability for combinatorial mathematics","venue":"cs.AI","work_id":"230b19a5-b9eb-44ac-a3fb-65265e7a5f55","year":2025},"citing_paper":{"arxiv_id":"2606.29493","last_updated":"2026-06-28T16:46:36Z","snapshot_observed_at":"2026-08-18T21:04:46.495934Z","submitted_at":"2026-06-28T16:46:36Z","title":"Faults in Our Formal Benchmarking: Dataset Defects and Evaluation Failures in Lean Theorem Proving","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T06:56:32.253843Z"},"links":{"cited_paper":"/paper/2505.03171","citing_paper":"/paper/2606.29493"},"observation_digest":"sha256:573eea113f7da0d118971e7b7289314a988e28c42419af4ff6247cfad81e5157","observation_id":"359d3628-9664-4e30-96f0-1ea0999c09ff","resolution":{"observed_at":"2026-06-30T07:04:21.947161Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:56:32.253843Z","title":"11 Faults in Our Formal Benchmarking A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.29493","last_updated":"2026-06-28T16:46:36Z","snapshot_observed_at":"2026-08-18T21:04:46.495934Z","submitted_at":"2026-06-28T16:46:36Z","title":"Faults in Our Formal Benchmarking: Dataset Defects and Evaluation Failures in Lean Theorem Proving","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T06:56:32.253843Z"},"links":{"citing_paper":"/paper/2606.29493"},"observation_digest":"sha256:5b50ea555a1630ba64e0a6c376e11bf9f9e2942a132a1734f4bd72b403596a53","observation_id":"d80b969e-29a2-42e8-bf2b-48d4de7043eb","resolution":{"observed_at":"2026-06-30T06:56:32.253843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:56:32.253843Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.29493","last_updated":"2026-06-28T16:46:36Z","snapshot_observed_at":"2026-08-18T21:04:46.495934Z","submitted_at":"2026-06-28T16:46:36Z","title":"Faults in Our Formal Benchmarking: Dataset Defects and Evaluation Failures in Lean Theorem Proving","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T06:56:32.253843Z"},"links":{"citing_paper":"/paper/2606.29493"},"observation_digest":"sha256:5a5d2301dc9e8f853ab05b159b512231ea832d90c7f1628f5e2f37a3319d4033","observation_id":"c4263bc3-8ca2-4cd6-b7c1-302063667b30","resolution":{"observed_at":"2026-06-30T06:56:32.253843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:56:32.253843Z","title":"They also release FormalMath Lite, a carefully selected subset of 425 problems (comprising 359 high school-level and 66 undergraduate- level problems)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.29493","last_updated":"2026-06-28T16:46:36Z","snapshot_observed_at":"2026-08-18T21:04:46.495934Z","submitted_at":"2026-06-28T16:46:36Z","title":"Faults in Our Formal Benchmarking: Dataset Defects and Evaluation Failures in Lean Theorem Proving","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T06:56:32.253843Z"},"links":{"citing_paper":"/paper/2606.29493"},"observation_digest":"sha256:616228f350a99f253edd19aaa2d1134d3aeb7c3337c87361f22a7a06a8ca342f","observation_id":"9d9de0ea-38e1-463c-9826-83283ffe9c31","resolution":{"observed_at":"2026-06-30T06:56:32.253843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:56:32.253843Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29493","last_updated":"2026-06-28T16:46:36Z","snapshot_observed_at":"2026-08-18T21:04:46.495934Z","submitted_at":"2026-06-28T16:46:36Z","title":"Faults in Our Formal Benchmarking: Dataset Defects and Evaluation Failures in Lean Theorem Proving","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T06:56:32.253843Z"},"links":{"citing_paper":"/paper/2606.29493"},"observation_digest":"sha256:25f2f5d5ac3952c6105430e72ade9b5ae39ae3bb3a2cfdc9a861c5f4a06833ec","observation_id":"e614c2c3-3048-4be7-8473-0bc2cc515186","resolution":{"observed_at":"2026-06-30T06:56:32.253843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:56:32.253843Z","title":"complete","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.29493","last_updated":"2026-06-28T16:46:36Z","snapshot_observed_at":"2026-08-18T21:04:46.495934Z","submitted_at":"2026-06-28T16:46:36Z","title":"Faults in Our Formal Benchmarking: Dataset Defects and Evaluation Failures in Lean Theorem Proving","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T06:56:32.253843Z"},"links":{"citing_paper":"/paper/2606.29493"},"observation_digest":"sha256:1d5d7417c1eddc60341afbf6c1f57286570d1433950a32291b11cb9bff4656e3","observation_id":"d7e727e3-7107-4878-b2de-8ca9ce1218a6","resolution":{"observed_at":"2026-06-30T06:56:32.253843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:56:32.253843Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29493","last_updated":"2026-06-28T16:46:36Z","snapshot_observed_at":"2026-08-18T21:04:46.495934Z","submitted_at":"2026-06-28T16:46:36Z","title":"Faults in Our Formal Benchmarking: Dataset Defects and Evaluation Failures in Lean Theorem Proving","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T06:56:32.253843Z"},"links":{"citing_paper":"/paper/2606.29493"},"observation_digest":"sha256:9a8b7bbf83779e1ad523bf43aa9b96a14715830f95aeca31b9f5a4532325e808","observation_id":"8caf23e3-40fd-4564-94b8-ce970bbd96d5","resolution":{"observed_at":"2026-06-30T06:56:32.253843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:56:32.253843Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29493","last_updated":"2026-06-28T16:46:36Z","snapshot_observed_at":"2026-08-18T21:04:46.495934Z","submitted_at":"2026-06-28T16:46:36Z","title":"Faults in Our Formal Benchmarking: Dataset Defects and Evaluation Failures in Lean Theorem Proving","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T06:56:32.253843Z"},"links":{"citing_paper":"/paper/2606.29493"},"observation_digest":"sha256:940c49a3a1db631d3521f498d6d7fee8d9feadc10da46240c4cc2fd740655ffa","observation_id":"184cc103-a8fe-47bb-a590-b78d3f4d94a1","resolution":{"observed_at":"2026-06-30T06:56:32.253843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:56:32.253843Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29493","last_updated":"2026-06-28T16:46:36Z","snapshot_observed_at":"2026-08-18T21:04:46.495934Z","submitted_at":"2026-06-28T16:46:36Z","title":"Faults in Our Formal Benchmarking: Dataset Defects and Evaluation Failures in Lean Theorem Proving","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T06:56:32.253843Z"},"links":{"citing_paper":"/paper/2606.29493"},"observation_digest":"sha256:1c72ab31e93d970f2239543af5c3873ddd20dcaef731ab40595e16f10114cb25","observation_id":"bf19361e-a381-4bf3-8247-2e2b5d00f51d","resolution":{"observed_at":"2026-06-30T06:56:32.253843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:56:32.253843Z","title":"This discharges approximately 60% of valid guards automatically","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29493","last_updated":"2026-06-28T16:46:36Z","snapshot_observed_at":"2026-08-18T21:04:46.495934Z","submitted_at":"2026-06-28T16:46:36Z","title":"Faults in Our Formal Benchmarking: Dataset Defects and Evaluation Failures in Lean Theorem Proving","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T06:56:32.253843Z"},"links":{"citing_paper":"/paper/2606.29493"},"observation_digest":"sha256:a8c06b376ac79c0d322abcaf7797ae93d8fda5e77d6badc8bd230c21a1ac3f4b","observation_id":"bc49de84-d541-4b21-85c5-97351097fb21","resolution":{"observed_at":"2026-06-30T06:56:32.253843Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:56:32.253843Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29493","last_updated":"2026-06-28T16:46:36Z","snapshot_observed_at":"2026-08-18T21:04:46.495934Z","submitted_at":"2026-06-28T16:46:36Z","title":"Faults in Our Formal Benchmarking: Dataset Defects and Evaluation Failures in Lean Theorem Proving","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T06:56:32.253843Z"},"links":{"citing_paper":"/paper/2606.29493"},"observation_digest":"sha256:f473e9e7485c61f5439df73b68e21bd7cd3b6ddbd47bac6662564c451d116d1d","observation_id":"f30979a5-3b1e-4750-aa55-23ed636fc8a8","resolution":{"observed_at":"2026-06-30T06:56:32.253843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:56:32.253843Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29493","last_updated":"2026-06-28T16:46:36Z","snapshot_observed_at":"2026-08-18T21:04:46.495934Z","submitted_at":"2026-06-28T16:46:36Z","title":"Faults in Our Formal Benchmarking: Dataset Defects and Evaluation Failures in Lean Theorem Proving","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T06:56:32.253843Z"},"links":{"citing_paper":"/paper/2606.29493"},"observation_digest":"sha256:b6fce344feac212d6db738de41eb71d6c2e516c7e1c20efa6b8f84e460f0c665","observation_id":"b76f3c93-b1ea-464d-80b2-2cf2e251592d","resolution":{"observed_at":"2026-06-30T06:56:32.253843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:56:32.253843Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29493","last_updated":"2026-06-28T16:46:36Z","snapshot_observed_at":"2026-08-18T21:04:46.495934Z","submitted_at":"2026-06-28T16:46:36Z","title":"Faults in Our Formal Benchmarking: Dataset Defects and Evaluation Failures in Lean Theorem Proving","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T06:56:32.253843Z"},"links":{"citing_paper":"/paper/2606.29493"},"observation_digest":"sha256:db6767aae99ca19032f6ba1c2ff76e0291c37041d2bdd97d11d9442423f727a1","observation_id":"087fa128-310a-4029-8a5f-dd27352dda9d","resolution":{"observed_at":"2026-06-30T06:56:32.253843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:56:32.253843Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29493","last_updated":"2026-06-28T16:46:36Z","snapshot_observed_at":"2026-08-18T21:04:46.495934Z","submitted_at":"2026-06-28T16:46:36Z","title":"Faults in Our Formal Benchmarking: Dataset Defects and Evaluation Failures in Lean Theorem Proving","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T06:56:32.253843Z"},"links":{"citing_paper":"/paper/2606.29493"},"observation_digest":"sha256:65042a2b079a8e21d601a4618fcba0c64dafd39674fcb5e9ef3ac4cdce258a44","observation_id":"88932f99-f1e6-44eb-b0c4-7095cb372668","resolution":{"observed_at":"2026-06-30T06:56:32.253843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:56:32.253843Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29493","last_updated":"2026-06-28T16:46:36Z","snapshot_observed_at":"2026-08-18T21:04:46.495934Z","submitted_at":"2026-06-28T16:46:36Z","title":"Faults in Our Formal Benchmarking: Dataset Defects and Evaluation Failures in Lean Theorem Proving","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T06:56:32.253843Z"},"links":{"citing_paper":"/paper/2606.29493"},"observation_digest":"sha256:6e748eda93c02afdaa7db66b81d66f62bc8fd3edb5acfd29d18cdb4229d1aa70","observation_id":"598687f0-411a-4b42-b5e1-cde3a3e9f931","resolution":{"observed_at":"2026-06-30T06:56:32.253843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:56:32.253843Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29493","last_updated":"2026-06-28T16:46:36Z","snapshot_observed_at":"2026-08-18T21:04:46.495934Z","submitted_at":"2026-06-28T16:46:36Z","title":"Faults in Our Formal Benchmarking: Dataset Defects and Evaluation Failures in Lean Theorem Proving","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T06:56:32.253843Z"},"links":{"citing_paper":"/paper/2606.29493"},"observation_digest":"sha256:41feb01504a782e10abb460457cc20de1bc6f40a613a2379c25ac781cae11688","observation_id":"c4cb1ad3-5c50-4b28-bbd2-4ba688d2fdd2","resolution":{"observed_at":"2026-06-30T06:56:32.253843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:56:32.253843Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29493","last_updated":"2026-06-28T16:46:36Z","snapshot_observed_at":"2026-08-18T21:04:46.495934Z","submitted_at":"2026-06-28T16:46:36Z","title":"Faults in Our Formal Benchmarking: Dataset Defects and Evaluation Failures in Lean Theorem Proving","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T06:56:32.253843Z"},"links":{"citing_paper":"/paper/2606.29493"},"observation_digest":"sha256:c8f37e5b7ba67a2d369c307dfaf48a1754097e5d6c0b41f01cbdee9bfc5306de","observation_id":"8d50a34e-5ea6-4eca-bae3-405575fc928d","resolution":{"observed_at":"2026-06-30T06:56:32.253843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:56:32.253843Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29493","last_updated":"2026-06-28T16:46:36Z","snapshot_observed_at":"2026-08-18T21:04:46.495934Z","submitted_at":"2026-06-28T16:46:36Z","title":"Faults in Our Formal Benchmarking: Dataset Defects and Evaluation Failures in Lean Theorem Proving","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T06:56:32.253843Z"},"links":{"citing_paper":"/paper/2606.29493"},"observation_digest":"sha256:35fd0e6ce4d679029d73ebc4bc000b0fd43e8893afd47ffc81c565a009fe0aaa","observation_id":"77bc1b99-d7e0-499a-86a7-23dd27ada549","resolution":{"observed_at":"2026-06-30T06:56:32.253843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:56:32.253843Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29493","last_updated":"2026-06-28T16:46:36Z","snapshot_observed_at":"2026-08-18T21:04:46.495934Z","submitted_at":"2026-06-28T16:46:36Z","title":"Faults in Our Formal Benchmarking: Dataset Defects and Evaluation Failures in Lean Theorem Proving","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-30T06:56:32.253843Z"},"links":{"citing_paper":"/paper/2606.29493"},"observation_digest":"sha256:20d9165345187e184937390868658dc4816ef255064e0b39dad05acf7f4eeb71","observation_id":"e4346a7b-84dc-4067-b30e-e5f9ffed86f8","resolution":{"observed_at":"2026-06-30T06:56:32.253843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:56:32.253843Z","title":"YES\". 6.DetailTagsmust be chosen ONLY from the allowed list. Output format (JSON): Verdict:","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29493","last_updated":"2026-06-28T16:46:36Z","snapshot_observed_at":"2026-08-18T21:04:46.495934Z","submitted_at":"2026-06-28T16:46:36Z","title":"Faults in Our Formal Benchmarking: Dataset Defects and Evaluation Failures in Lean Theorem Proving","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-30T06:56:32.253843Z"},"links":{"citing_paper":"/paper/2606.29493"},"observation_digest":"sha256:6facee635fd03e1110267726dceb8d7199eb251c8dd2ba9d296ece621cb3bb3a","observation_id":"2f21dfc3-4375-482f-9388-9b91277d46a5","resolution":{"observed_at":"2026-06-30T06:56:32.253843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T06:56:32.253843Z","title":"prime p dividing its order","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29493","last_updated":"2026-06-28T16:46:36Z","snapshot_observed_at":"2026-08-18T21:04:46.495934Z","submitted_at":"2026-06-28T16:46:36Z","title":"Faults in Our Formal Benchmarking: Dataset Defects and Evaluation Failures in Lean Theorem Proving","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T06:56:32.253843Z"},"links":{"citing_paper":"/paper/2606.29493"},"observation_digest":"sha256:b789f903c20f3372e0c7948c806f299bbc63c93895024431a439e91ea8dafa54","observation_id":"9481825c-dc7f-460d-bab1-6260a75ec328","resolution":{"observed_at":"2026-06-30T06:56:32.253843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.29493","last_updated":"2026-06-28T16:46:36Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-18T21:04:46.495934Z","submitted_at":"2026-06-28T16:46:36Z","title":"Faults in Our Formal Benchmarking: Dataset Defects and Evaluation Failures in Lean Theorem Proving"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 1 inbound Pith citation observation for arXiv:2606.29493."}