{"as_of":"2026-08-08T02:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ba5aee5e26349b7bb18cb7738e0e73718f970a0329452b4d9faa28bb4593e33d","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:18:41.054671Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T09:29:45.021656Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-16T09:30:48.177781Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":"2506.10903","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.10903","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"emnlp-demos.44/","venue":null,"work_id":"ad6e111f-bbd5-4df7-b83d-8711bbd1e073","year":2025},"citing_paper":{"arxiv_id":"2601.23166","last_updated":"2026-05-07T11:23:05Z","snapshot_observed_at":"2026-07-06T22:43:45.998263Z","submitted_at":"2026-01-30T16:48:33Z","title":"Monotonic Reference-Free Refinement for Autoformalization","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T09:29:45.021656Z"},"links":{"cited_paper":"/paper/2506.10903","citing_paper":"/paper/2601.23166"},"observation_digest":"sha256:2e8a7c9e79163ddb01b594065a508c18fcec9991fa3d376fdd9ff2e526148de8","observation_id":"dc4654cd-50d5-40c0-9878-6cbf9d206818","resolution":{"observed_at":"2026-05-16T09:30:48.179885Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.10903/citation-record","integrity":"/paper/2506.10903/integrity","json":"/paper/2506.10903/citation-record.json","paper":"/paper/2506.10903"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:32.195737Z","title":"Draft, sketch, and prove: Guiding formal theorem provers with informal proofs","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:32.195737Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:d414bfca40fdf2990f4ba29c6d2c588558b1b4d1b504a2687736a7a0ede5ced7","observation_id":"a816238d-e1ab-4c7f-adf7-5d6b99775fc0","resolution":{"observed_at":"2026-08-07T04:18:32.195737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:50.291420Z","title":"Ren, Junxiao Song, Zhihong Shao, Wanjia Zhao, Haocheng Wang, Bo Liu, Liyue Zhang, Xuan Lu, Qiushi Du, Wenjun Gao, Haowei Zhang, Qihao Zhu, Dejian Yang, Zhibin Gou, Z.F","venue":null,"work_id":"fe17ef1a-2c9a-4286-8e3b-1c667386668f","year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:32.275985Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:b163e0e10836d484768417ff240bba76c75da685a0e7d0e8335ebc0ae611754e","observation_id":"137b8a50-ca7c-482a-951d-c2fb60725cc0","resolution":{"observed_at":"2026-08-07T04:18:50.397037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07640","last_updated":"2025-04-19T13:53:05Z","snapshot_observed_at":"2026-07-06T20:34:48.850154Z","submitted_at":"2025-02-11T15:27:35Z","title":"Goedel-Prover: A Frontier Model for Open-Source Automated Theorem Proving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.07640","snapshot_observed_at":"2026-08-07T04:18:32.420330Z","title":"Goedel-prover: A frontier model for open-source automated theorem proving, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:32.420330Z"},"links":{"cited_paper":"/paper/2502.07640","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:c9427d4a561bd95a195933eeec8a93f0c02cd3773fe74f3330b917934d8afd22","observation_id":"91dfdb80-5796-4738-addf-3a8f02fb9094","resolution":{"observed_at":"2026-08-07T04:18:32.420330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:50.057100Z","title":"Improver: Agent-based auto- mated proof optimization","venue":null,"work_id":"e392d9fd-0fb2-44ff-8912-e30c2fbb91d8","year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:32.532344Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:2f3cc9703e0ababdf3c0c15812f7eb1d84772f378fdb1767c61d3f42636bcd05","observation_id":"d272895d-4865-4805-93a2-6e13de144499","resolution":{"observed_at":"2026-08-07T04:18:50.191854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:49.801960Z","title":"Learning formal mathematics from intrinsic motivation","venue":null,"work_id":"009be48f-2030-427e-ac8d-767a5e33b1c9","year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:32.672032Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:1fa1f90b8b8adee88644b2c00159fb01c41a1e0b235c3048ff38675a945d788e","observation_id":"75d131e4-b583-4ee6-a264-8d4735dd8f7a","resolution":{"observed_at":"2026-08-07T04:18:49.950599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02735","last_updated":"2025-05-05T15:37:00Z","snapshot_observed_at":"2026-08-07T23:36:07.412083Z","submitted_at":"2025-05-05T15:37:00Z","title":"FormalMATH: Benchmarking Formal Mathematical Reasoning of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.02735","snapshot_observed_at":"2026-08-07T04:18:32.811609Z","title":"Formalmath: Benchmarking formal mathematical reasoning of large language models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:32.811609Z"},"links":{"cited_paper":"/paper/2505.02735","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:39a86556086a779703b4c9a1fe4d4f3207de67a74ef8057894ecc6abde34460a","observation_id":"35677c87-0245-4d30-b063-71530db8b180","resolution":{"observed_at":"2026-08-07T04:18:32.811609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16075","last_updated":"2024-12-20T17:19:24Z","snapshot_observed_at":"2026-08-05T03:18:11.955456Z","submitted_at":"2024-12-20T17:19:24Z","title":"Formal Mathematical Reasoning: A New Frontier in AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16075","snapshot_observed_at":"2026-08-07T04:18:32.934134Z","title":"Formal mathematical reasoning: A new frontier in ai, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:32.934134Z"},"links":{"cited_paper":"/paper/2412.16075","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:75c5f1c8339bc211d6fdd104093df54af8780cd11cca629fb966b23973ffb6b3","observation_id":"ed735183-5cc2-4980-b111-503812ddb3c8","resolution":{"observed_at":"2026-08-07T04:18:32.934134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:33.046527Z","title":"Logic-LM: Empowering large language models with symbolic solvers for faithful logical reasoning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:33.046527Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:759963c04b8d053b8a5dd092b95884c688feacdc765dff6cc45f3fcdca795822","observation_id":"f4062c19-fdea-48f6-8940-82595d81160d","resolution":{"observed_at":"2026-08-07T04:18:33.046527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24264","last_updated":"2025-05-30T06:38:39Z","snapshot_observed_at":"2026-08-07T12:25:00.520357Z","submitted_at":"2025-05-30T06:38:39Z","title":"Faithful and Robust LLM-Driven Theorem Proving for NLI Explanations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24264","snapshot_observed_at":"2026-08-07T04:18:33.164701Z","title":"Faithful and robust llm-driven theorem proving for nli explanations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:33.164701Z"},"links":{"cited_paper":"/paper/2505.24264","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:ae311b945a38e96cc7ff975d0b53c609e8501575ff88a5dfc7ada5d5dc202091","observation_id":"18ad6655-73c1-46cd-81ce-1d69c186e9d8","resolution":{"observed_at":"2026-08-07T04:18:33.164701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:49.531262Z","title":"Dennis, and Andre Freitas","venue":null,"work_id":"4a83a2ee-339d-4b53-a2a9-1dcbcceda8c8","year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:33.300555Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:c40f95ab017098ce34e4ea95f0c72f8aba81ddc6bdafb2b2982cbb57d62991c2","observation_id":"dc537e8e-e477-42a3-9675-eb46c219e13b","resolution":{"observed_at":"2026-08-07T04:18:49.647213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:49.279590Z","title":"Autoformalization with large language models","venue":null,"work_id":"bbe5fe87-8d05-4809-8674-ec5bd8a78b2b","year":2022},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:33.622889Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:1012905fe79c809288755c742578625cfe42b49ddb41b97f8284b2a5f0dc4d95","observation_id":"102261bd-0257-4fae-a262-88dc703e0259","resolution":{"observed_at":"2026-08-07T04:18:49.409341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:49.047615Z","title":"Consistent autoformalization for constructing mathematical libraries","venue":null,"work_id":"f2df57e7-0542-4973-953e-6f35eefdc6a8","year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:33.790467Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:feefa6d105aed110d6cf44d31667fbdaf7a5eb86cccef537bfcdd232f407d9fa","observation_id":"adf526b7-37f6-45d8-bf35-408ab94636e4","resolution":{"observed_at":"2026-08-07T04:18:49.157181Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:48.749875Z","title":"Formalizing complex mathematical statements with llms: A study on mathematical definitions, 2025","venue":null,"work_id":"f71ada76-6eaf-4e83-8ccc-169d90d6617c","year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:33.924912Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:07f4d6920e8b517dea40ede5b84724c72e8b48904f28be529a07cb5469fe8d69","observation_id":"8e6ae0de-335e-4f1c-819a-132ccf2cc1fb","resolution":{"observed_at":"2026-08-07T04:18:48.907155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:48.508527Z","title":null,"venue":null,"work_id":"507ab936-1268-4d7a-b3a8-65252789e280","year":2000},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:34.098846Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:b22ee7b2ad1ee78d93777e07bb33b7b598401f4498f8190068beed106442fd01","observation_id":"001367c0-3118-4ae0-b04d-ac25c0afdc2b","resolution":{"observed_at":"2026-08-07T04:18:48.600638Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:48.263156Z","title":"The lean theorem prover (system description)","venue":null,"work_id":"105e5d28-e1e6-4713-8b07-4a9ef008c764","year":2015},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:34.249390Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:1cbc9ee8cca7b0e233eddcfbe2c9814a62918c0d9bf690d024f5f5fce55f2b47","observation_id":"63f2c65f-bb2f-4d83-afa7-582da3a4167a","resolution":{"observed_at":"2026-08-07T04:18:48.397535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:48.031508Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":"0628b607-f118-41e0-b5c7-6163c8ed3570","year":2023},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:34.432097Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:e4f721f6cc9dd0b129b20a27efcda8ebc1ccbc4b8928a493d4390c2e1a8ec896","observation_id":"1571152a-433d-4204-9f1e-cd191b04572b","resolution":{"observed_at":"2026-08-07T04:18:48.145267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:47.770391Z","title":"minif2f: a cross-system benchmark for formal olympiad-level mathematics","venue":null,"work_id":"2d05e10d-389e-4779-aa6b-556028cd477b","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:34.562778Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:e8ebb6fde6620cb305627b08ef3d6a42374847c273d9e80bfc20611305e09e34","observation_id":"74021821-a3e1-4a4a-bbd9-23a8a17e825f","resolution":{"observed_at":"2026-08-07T04:18:47.862292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:34.919040Z","title":"Ayers, Dragomir Radev, and Jeremy Avigad","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:34.919040Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:919858f5fa03b3a5dd4555a3e4c2640f095343163cb830095e38d7bd7429a6cd","observation_id":"47aac0b0-bdfe-42a6-9f1b-9f7864f60632","resolution":{"observed_at":"2026-08-07T04:18:34.919040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:35.048175Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:35.048175Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:b1da87c69d84f9c3915eeb4d3934daa8b43197c1094d6e7529d023b3860bba13","observation_id":"37032d3a-37ac-4c07-9d44-6cc6ad0ac01f","resolution":{"observed_at":"2026-08-07T04:18:35.048175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:35.147923Z","title":"chrF: character n-gram F-score for automatic MT evaluation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:35.147923Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:865c5242cee2a47ebe772320301c5d2af600d6ed974cff7b88607e8286b2d866","observation_id":"ae2b1546-3a2c-4ffd-9afa-c804c94c7b7d","resolution":{"observed_at":"2026-08-07T04:18:35.147923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:35.273746Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:35.273746Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:f339fc3c6c66f8913f0e11d08deed00ce81bae74466c9547388de041812a39e9","observation_id":"a9f4a789-209f-490d-9a2b-81fab12a788e","resolution":{"observed_at":"2026-08-07T04:18:35.273746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T04:18:35.413820Z","title":"Gpt-4 technical report, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:35.413820Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:5d63178cf9546e612e5daff5baa69a5034e86ebd718a233f85a4e83c20dad71f","observation_id":"2dbd116f-a8d9-41e4-aba6-5a76d2fb2468","resolution":{"observed_at":"2026-08-07T04:18:35.413820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:35.595478Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:35.595478Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:96eaf3a511489315ecb3379a018dea5848720f711827787bc3bb37131aec172f","observation_id":"b52d544c-1183-4060-9c2d-f7634d36decd","resolution":{"observed_at":"2026-08-07T04:18:35.595478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T04:18:35.713877Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:35.713877Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:392ddce0819a41a5ff013cbfd1600ef8dc65aaf597f66517fa20aa602d14ac76","observation_id":"3bea1d13-df8c-486c-bdb5-ece8dbb8bfed","resolution":{"observed_at":"2026-08-07T04:18:35.713877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T04:18:35.867509Z","title":"Qwen2.5 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:35.867509Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:4f346374ea1a44045ceed288cc7817f93c4ea398f70f35d99ff9f080a2dcd7b0","observation_id":"333f42d6-2093-4662-8ca7-c489eabde370","resolution":{"observed_at":"2026-08-07T04:18:35.867509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:47.280000Z","title":"Enhancing ethical explanations of large language models through iterative symbolic refinement","venue":null,"work_id":"b80e890f-3655-484e-ac6a-3f53ab1e23e8","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:36.004769Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:60439349f7b796d2e62033270faa5c66e2e5fda827bb058970f20cf2790db40a","observation_id":"e0644526-4e3a-4db7-b468-0c8f226d2275","resolution":{"observed_at":"2026-08-07T04:18:47.378180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:46.730897Z","title":"Jiang, Daniel Raggi, Wenda Li, and Mateja Jamnik","venue":null,"work_id":"0383820a-0be0-4599-8514-e0d3f133540a","year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:36.305644Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:977689242bea5e454be3585629bb20aa000b998a2eca96cd33ab85e485382c05","observation_id":"ea25568f-b3a0-4d18-b498-36ba5a2aeae9","resolution":{"observed_at":"2026-08-07T04:18:46.811020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:36.491908Z","title":"Towards autoformalization of mathe- matics and code correctness: Experiments with elementary proofs","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:36.491908Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:d056bba8b5c8aabf5be9e9dd0c399cab2f7fa14ab0f2eef9d568167f60f6aa1f","observation_id":"21afc887-d59f-442c-82a1-ae126ab38535","resolution":{"observed_at":"2026-08-07T04:18:36.491908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:46.959315Z","title":"URL https://aclanthology.org/2024","venue":null,"work_id":"94cb2b17-c5ce-4a4b-ad80-a97b9f3dc807","year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:36.188422Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:eacdd1e46c7cfc41508dafd60c6304f80ddd0a7af685a5be5530b58a42fa41a0","observation_id":"beb74f61-cf34-4f7f-b3da-6085559f02c7","resolution":{"observed_at":"2026-08-07T04:18:47.098812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:46.495646Z","title":"Rethinking and improving autoformalization: towards a faithful metric and a dependency retrieval-based approach","venue":null,"work_id":"e784137f-8838-40f0-9ae0-5a8a68d57ce4","year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:36.813396Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:0aa7b9f7f0ff82f7aa96efac8463b9d8bae52307cf98dacdbb26d7bb1db60676","observation_id":"cd3f2379-5699-4520-b467-8e93aef866b3","resolution":{"observed_at":"2026-08-07T04:18:46.618070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:46.271319Z","title":"Process-driven autoformalization in lean 4, 2024","venue":null,"work_id":"a04bb0fa-8cfc-45a6-804a-ac77697e40be","year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:36.948080Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:0bd2b7810753d9fb593b564cf2efc9717a002cda65c3388db7a210fbbe25c558","observation_id":"c3cdeb5b-e500-453a-b856-ef46c5be2a5b","resolution":{"observed_at":"2026-08-07T04:18:46.352503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15626","last_updated":"2023-10-27T16:00:20Z","snapshot_observed_at":"2026-07-06T15:47:26.532273Z","submitted_at":"2023-06-27T17:05:32Z","title":"LeanDojo: Theorem Proving with Retrieval-Augmented Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15626","snapshot_observed_at":"2026-08-07T04:18:36.682669Z","title":"Swope, Alex Gu, Rahul Chalamala, Peiyang Song, Shixing Yu, Saad Godil, Ryan Prenger, and Anima Anandkumar","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:36.682669Z"},"links":{"cited_paper":"/paper/2306.15626","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:4c0ffe6c508c96da483e370f51ff38dcd31d8f691b05832ecde0c1b987e8ad00","observation_id":"1d0d0b32-4316-4192-aeff-b148aa2ea300","resolution":{"observed_at":"2026-08-07T04:18:36.682669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:46.039749Z","title":"Jiang, Wenda Li, and Mateja Jamnik","venue":null,"work_id":"fad8e67a-4174-4871-9fbb-102f098988d9","year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:37.243294Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:668069dc092bd3dce7c933626047f4408c6c6010875b2160ed5f603d46a4f095","observation_id":"6ff906c5-70ef-4cef-bbb5-3508baaec954","resolution":{"observed_at":"2026-08-07T04:18:46.159363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:45.820788Z","title":"Atlas: Autoformalizing theorems through lifting, augmentation, and synthesis of data,","venue":null,"work_id":"a63428bb-52e2-42c5-b548-2b64fd3f8ca4","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:37.400350Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:65e95c617ae02cf54351a6afac588a1da85064639b6b29ab3275bcac54b68938","observation_id":"4d3ae176-89da-43b3-b7e4-412ae99385df","resolution":{"observed_at":"2026-08-07T04:18:45.933592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:37.081378Z","title":"Autoformalize mathematical statements by symbolic equivalence and semantic consistency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:37.081378Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:3773820d464401119fbd472a052cc8f57fd60f7f45db89d4e5c5a3e9b81c417d","observation_id":"0c7db4fb-86ba-4368-8d0f-462518c4710f","resolution":{"observed_at":"2026-08-07T04:18:37.081378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10135","last_updated":"2024-10-14T03:58:35Z","snapshot_observed_at":"2026-08-07T23:32:58.884993Z","submitted_at":"2024-10-14T03:58:35Z","title":"FormalAlign: Automated Alignment Evaluation for Autoformalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10135","snapshot_observed_at":"2026-08-07T04:18:37.768435Z","title":"Formalalign: Automated alignment evaluation for autoformalization, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:37.768435Z"},"links":{"cited_paper":"/paper/2410.10135","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:ccaf22d48719f91b1901d5c197cd8bb9c37eac0bbc1d0b0793a941b579739f27","observation_id":"1eaac6e5-82b5-4339-91d3-8e3d656f47f4","resolution":{"observed_at":"2026-08-07T04:18:37.768435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:37.937243Z","title":"Branch-solve-merge improves large language model evaluation and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:37.937243Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:b569a7cdba1f65f8c42e69766a4c7b7768fab8732e7e328e65a702aa9aea3a94","observation_id":"6ad1e9c1-7d6d-4634-a860-c8a043088537","resolution":{"observed_at":"2026-08-07T04:18:37.937243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02666","last_updated":"2024-08-08T17:09:58Z","snapshot_observed_at":"2026-08-06T10:06:21.140448Z","submitted_at":"2024-08-05T17:57:02Z","title":"Self-Taught Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02666","snapshot_observed_at":"2026-08-07T04:18:38.084976Z","title":"Self-taught evaluators, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:38.084976Z"},"links":{"cited_paper":"/paper/2408.02666","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:ff806f9bc4f1925636867601f3ff2113d0efc9c00c3797dd5aa1cc36e9ecaca7","observation_id":"f6fc7ac3-3d55-4304-b3b2-e556f1ec9ee3","resolution":{"observed_at":"2026-08-07T04:18:38.084976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:37.664687Z","title":"Improving autoformaliza- tion using type checking, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:37.664687Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:4e05e6c72c0f661aa4b98eab18f8a8c443fee571b48738b406b668a919cf0919","observation_id":"60ff8893-e2a2-41f5-ae70-28be40973b6a","resolution":{"observed_at":"2026-08-07T04:18:37.664687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:38.375950Z","title":"J1: Incentivizing thinking in llm-as-a-judge via reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:38.375950Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:3e6c5d8a169d08254080be9ceac470e06d6c29d5f465ecda2bc869dd0af8918d","observation_id":"1d1f828f-2576-4cfa-bf83-6ca7805c7c51","resolution":{"observed_at":"2026-08-07T04:18:38.375950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18403","last_updated":"2025-06-02T11:31:19Z","snapshot_observed_at":"2026-07-06T18:37:21.973331Z","submitted_at":"2024-06-26T14:56:13Z","title":"LLMs instead of Human Judges? A Large Scale Empirical Study across 20 NLP Evaluation Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18403","snapshot_observed_at":"2026-08-07T04:18:38.572175Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:38.572175Z"},"links":{"cited_paper":"/paper/2406.18403","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:775bcaf638a6e24e212db1c4357f6a1e753fb552982eab5e3c2efca06cc71434","observation_id":"15a2d426-3228-482a-9c22-0ce3cae0da50","resolution":{"observed_at":"2026-08-07T04:18:38.572175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-02T10:23:50.881300Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-07T04:18:38.698535Z","title":"A survey on llm-as-a-judge, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:38.698535Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:f44f6a69745bf7fafc891b62f39ac1ca8fd692dfb1dd1ad39472b30227f6dc80","observation_id":"dd5a74ee-294e-4314-a397-44d9d4c9fc11","resolution":{"observed_at":"2026-08-07T04:18:38.698535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12501","last_updated":"2025-04-07T05:22:27Z","snapshot_observed_at":"2026-08-07T18:10:20.154725Z","submitted_at":"2025-02-18T03:31:06Z","title":"Crowd Comparative Reasoning: Unlocking Comprehensive Evaluations for LLM-as-a-Judge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12501","snapshot_observed_at":"2026-08-07T04:18:38.239873Z","title":"Crowd comparative reasoning: Unlocking comprehensive evaluations for llm-as-a-judge, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:38.239873Z"},"links":{"cited_paper":"/paper/2502.12501","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:d857d87a32c766a59a8a9c8bd4f97e5e26af4739afcbc243379ec421d1e90cd3","observation_id":"24134fc3-59a4-4513-8ce4-0d407d1b94e2","resolution":{"observed_at":"2026-08-07T04:18:38.239873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23754","last_updated":"2025-06-03T11:23:21Z","snapshot_observed_at":"2026-08-07T12:36:08.594054Z","submitted_at":"2025-05-29T17:59:39Z","title":"DeepTheorem: Advancing LLM Reasoning for Theorem Proving Through Natural Language and Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23754","snapshot_observed_at":"2026-08-07T04:18:39.132366Z","title":"Deeptheorem: Advancing llm reasoning for theorem proving through natural language and reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:39.132366Z"},"links":{"cited_paper":"/paper/2505.23754","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:18d1e81b52cc0ac02c329fb3bf1eae629f418cc9b88e30e26feff00fb2c4704c","observation_id":"433988b7-2bc8-4b3d-8835-dbc4e74d7e36","resolution":{"observed_at":"2026-08-07T04:18:39.132366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:45.565762Z","title":"Assessing judging bias in large reasoning models: An empirical study,","venue":null,"work_id":"11622d72-8ade-40a9-8ffd-1ff73d42cb84","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:38.874413Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:0971abb6fc466f48b7ec047aa0e19708a24f7d19388f785156bbc658d09c62a8","observation_id":"e654143c-fe28-4cd0-84c9-265a5007d2e5","resolution":{"observed_at":"2026-08-07T04:18:45.671838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09946","last_updated":"2025-04-18T02:05:38Z","snapshot_observed_at":"2026-08-07T16:06:00.056361Z","submitted_at":"2025-04-14T07:14:27Z","title":"Assessing Judging Bias in Large Reasoning Models: An Empirical Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09946","snapshot_observed_at":"2026-08-07T04:18:39.012600Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:39.012600Z"},"links":{"cited_paper":"/paper/2504.09946","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:9637e186ee41bea3ac58bd23a3a63d3ee2e73f8e3a5df3faa22170e34c212d51","observation_id":"9c5711f3-5794-460f-a6df-54f652c3d180","resolution":{"observed_at":"2026-08-07T04:18:39.012600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:45.292944Z","title":null,"venue":null,"work_id":"402cefa5-d70a-4815-a7fd-5bcde770fcd9","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:39.261252Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:cd04e471e73f87de99187d74bab3a001d506d618b044c206528090b689312ab0","observation_id":"4c1bd57e-0c22-4e90-a74f-5c29b3d838a0","resolution":{"observed_at":"2026-08-07T04:18:45.443347Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:44.967555Z","title":null,"venue":null,"work_id":"f1d587dc-338a-4112-90e1-8f592a798e65","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:39.461393Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:af2c7b427684db8b5ffc38c261608521d7b61bb9f7f12814475839d137640fa5","observation_id":"9a85e2f3-ae8e-401a-ba33-8a3d30b96e77","resolution":{"observed_at":"2026-08-07T04:18:45.103398Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:44.785563Z","title":null,"venue":null,"work_id":"19fda17b-8ae6-4d44-b58e-76da8743747c","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:39.614636Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:e18289805f431045996d83acebbc7ba9b888ff4e81be04880f8a4805f8d29d04","observation_id":"b7e0f182-6e81-4afe-bbf3-58e4cf7353f8","resolution":{"observed_at":"2026-08-07T04:18:44.912106Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:44.557739Z","title":null,"venue":null,"work_id":"0745f265-a947-4321-b416-94287c57c16a","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:39.767627Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:8ed409e32fa4183ffc924487bdd0a848087fb5104fde04cfa614ab4b7523e082","observation_id":"781f4874-c6f8-4d24-9488-e7af0ab01019","resolution":{"observed_at":"2026-08-07T04:18:44.668304Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:44.273045Z","title":null,"venue":null,"work_id":"e52d96a9-5baa-4c0a-9cf0-ed53a2eec893","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:39.871380Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:9f4ab676699d622a884d664bb4c69a4b0686ddaee64b4a09901a3162a9ed2515","observation_id":"107593b5-e04c-4598-a95c-eeff9355911f","resolution":{"observed_at":"2026-08-07T04:18:44.419887Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:44.058644Z","title":null,"venue":null,"work_id":"383e4350-84c5-41b2-a608-c84920345da8","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:39.985638Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:67fb7b5f37ce643c9b483be47941745c34b462f25af0a39cd6d74c91f4c96d17","observation_id":"17c5e063-8659-4a54-88b3-01b9a2313b6c","resolution":{"observed_at":"2026-08-07T04:18:44.160267Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:43.831904Z","title":null,"venue":null,"work_id":"5a9659c4-db37-4b8d-a68e-cee4ca4a5f0b","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:40.098574Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:29d089be8f293f9dc740a4ffba3047b50611ece6f20f1c6e318ac72490b70bdc","observation_id":"02ace0ff-3be6-4064-90f0-162cfda66110","resolution":{"observed_at":"2026-08-07T04:18:43.942277Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:43.525576Z","title":null,"venue":null,"work_id":"aea423f8-e06a-4527-a738-7530a719329a","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:40.263334Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:45b77b4baa34822af3daa6cba275114c362ad088eb8c5f4c3bb552527967970c","observation_id":"6d05781f-064a-4e99-a2e0-8036bf1498e3","resolution":{"observed_at":"2026-08-07T04:18:43.688713Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:43.267630Z","title":null,"venue":null,"work_id":"bb888837-1e27-4258-b0e9-2098a19552bc","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:40.380673Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:c9695954d577a45c5d298094d63f90d973d8440739978ae8a9d5a87e7a4047dc","observation_id":"261fb21b-acc0-4aff-a9c7-ddeb5b01092c","resolution":{"observed_at":"2026-08-07T04:18:43.407700Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:43.008415Z","title":null,"venue":null,"work_id":"8eaffedc-a659-47da-896c-737c5e2d100a","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:40.502132Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:0ded347c95d55e1e032fcb92b4d314c9328e815bc3a3df50340b4b7a56abf4a3","observation_id":"8118648f-d720-48bd-80e6-5e44868d4b3e","resolution":{"observed_at":"2026-08-07T04:18:43.093832Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:42.703772Z","title":null,"venue":null,"work_id":"b6ae9eb7-21f6-4315-8ee4-ca8c0cf86860","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:40.606262Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:67674a33ed6789e089e2c37b096d5b056e7f4fb9375cae1d8d35e4ab1caf0479","observation_id":"f8b51ee0-2a3b-467c-b8e0-6b74b0b14180","resolution":{"observed_at":"2026-08-07T04:18:42.853290Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:42.414231Z","title":"15 Purpose Content Basic You are an expert in formal language {formal_language}","venue":null,"work_id":"14211ce0-79e6-4356-994e-b62ff735424c","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:40.724866Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:bae56b2663bd91db7a020dee267ba93a111689c4f855f902e7d720219d329cc3","observation_id":"e6df49b0-4b5a-4383-b759-d4e3c3a6c432","resolution":{"observed_at":"2026-08-07T04:18:42.549214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:42.123115Z","title":"True\" or","venue":null,"work_id":"f89978ad-7aa9-490c-b617-fac4f965a2ce","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:40.886817Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:0aebf0a18e8b4bc4b725ded18ef241663fb780ea291d0b0fd4f65c74308ae058","observation_id":"79f0eca7-498c-42f9-a217-827f750abd28","resolution":{"observed_at":"2026-08-07T04:18:42.266962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:41.885083Z","title":"real ⇒ real","venue":null,"work_id":"ccbe4b32-2f44-4900-a699-f47cafed3738","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:41.054671Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:5fd57f46b25a2d454db84112095142a908c50e5db95991436a31abebf5d143c2","observation_id":"5f14c5e3-8597-4858-8fe3-ed2c9e6a390f","resolution":{"observed_at":"2026-08-07T04:18:41.953448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:47.548105Z","title":null,"venue":null,"work_id":"79ad63ef-90fa-4bfe-a382-0e2b7ba46edd","year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:34.757295Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:ffc68bf6577edf668ebee1340fc5d1152cc71c4cfeea4a68d39c5b259053bd98","observation_id":"49864cd8-4a36-4a36-a88a-5d12268d63a7","resolution":{"observed_at":"2026-08-07T04:18:47.645468Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:33.473040Z","title":"doi: 10.18653/v1/2024.emnlp-main.172","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:33.473040Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:4adc813e120eae3f4e6e31388d95be30214f6da6340d67abfce5bbf599412c12","observation_id":"315b83f6-3c65-4b4b-84f5-c33ba707b30e","resolution":{"observed_at":"2026-08-07T04:18:33.473040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:18:37.536531Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:37.536531Z"},"links":{"citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:5ddcedcdc8b47283217fe4692e17a78a15c2b799e5e194091fac2b9ee9e957b0","observation_id":"d0d82ccf-bfb5-44be-bf8e-eb045006c155","resolution":{"observed_at":"2026-08-07T04:18:37.536531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T04:11:48.779346Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 1 inbound Pith citation observation for arXiv:2506.10903."}