{"as_of":"2026-08-19T22:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c13a6542adc8b3b5d65482b10d9da7a13f84c5fda123b5131cec59b6fab1dbfc","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":34,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T10:44:03.024403Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T02:35:53.846004Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-08-12T13:21:05.601952Z","title":"Bowman, Tim Rockt ¨aschel, and Ethan Perez","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2411.16345","last_updated":"2025-02-14T09:32:11Z","snapshot_observed_at":"2026-08-18T01:13:52.673145Z","submitted_at":"2024-11-25T12:44:02Z","title":"Preference Optimization for Reasoning with Pseudo Feedback","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T13:21:05.601952Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2411.16345"},"observation_digest":"sha256:cef90fc970d1170b52a6d4529d0469750b0b96d43fb064649b82c32ce109d39a","observation_id":"9bd8fbcd-961d-4b06-b92d-302f4ed7e754","resolution":{"observed_at":"2026-08-12T13:21:05.601952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-08-11T10:36:17.379413Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16468","last_updated":"2026-06-17T06:47:51Z","snapshot_observed_at":"2026-08-17T20:36:44.733050Z","submitted_at":"2024-12-21T03:51:04Z","title":"The Road to Artificial SuperIntelligence: A Comprehensive Survey of Superalignment","version":4},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T10:36:17.379413Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2412.16468"},"observation_digest":"sha256:ec123bb25d8d81d5d9112a4f4b74f5173166080aad9f9b34f4845d1a78d8ab6a","observation_id":"16568e58-ce99-4581-9090-32675de33fd6","resolution":{"observed_at":"2026-08-11T10:36:17.379413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":"2407.13692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-07-09T02:35:53.846004Z","title":"Prover-verifier games improve legibility of llm outputs","venue":"cs.CL","work_id":"2bebdadc-2df7-4816-93c8-70252a1645eb","year":2024},"citing_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-13T15:51:29.022336Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2412.21187"},"observation_digest":"sha256:0bffab547e59e82d3928ecb1739e3fea1be160341d8cc7e2c89c2ffe68355992","observation_id":"ad1e4531-7843-493d-a8ed-d10c1a64ae53","resolution":{"observed_at":"2026-05-13T15:51:29.224911Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-08-10T20:33:38.188792Z","title":"Prover-verifier games improve legibility of llm outputs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.07886","last_updated":"2025-01-14T06:54:17Z","snapshot_observed_at":"2026-08-15T12:48:36.708719Z","submitted_at":"2025-01-14T06:54:17Z","title":"Iterative Label Refinement Matters More than Preference Optimization under Weak Supervision","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-10T20:33:38.188792Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2501.07886"},"observation_digest":"sha256:1fd779f41c28d16c264985c6a3dc3ccb28ca170eee404d689f2ab272bbdfb061","observation_id":"903a90db-54c4-4435-a4f7-d99fb61b5ab4","resolution":{"observed_at":"2026-08-10T20:33:38.188792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-08-10T19:39:10.481871Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.09891","last_updated":"2025-01-17T00:41:44Z","snapshot_observed_at":"2026-08-15T02:23:45.719567Z","submitted_at":"2025-01-17T00:41:44Z","title":"Evolving Deeper LLM Thinking","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T19:39:10.481871Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2501.09891"},"observation_digest":"sha256:e55bc85ba0399fdf889ed5de0693f3751f9639e5644dee4ad972d131d2bce96d","observation_id":"347c87ed-b805-488d-9cdb-02748c08586a","resolution":{"observed_at":"2026-08-10T19:39:10.481871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":"2407.13692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-07-09T02:35:53.846004Z","title":"Prover-verifier games improve legibility of llm outputs","venue":"cs.CL","work_id":"2bebdadc-2df7-4816-93c8-70252a1645eb","year":2024},"citing_paper":{"arxiv_id":"2503.11926","last_updated":"2025-03-14T23:50:34Z","snapshot_observed_at":"2026-08-17T15:42:03.133713Z","submitted_at":"2025-03-14T23:50:34Z","title":"Monitoring Reasoning Models for Misbehavior and the Risks of Promoting Obfuscation","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-21T07:24:12.845841Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2503.11926"},"observation_digest":"sha256:1bbf147c6c6d0d5461af88eadcf0bb521b1e889b84b4994b0726872894a3bb3b","observation_id":"75d070b9-6f7a-4d59-9e01-4fd92bbb97c7","resolution":{"observed_at":"2026-05-21T07:24:13.028284Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-08-16T10:44:03.024403Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17404","last_updated":"2025-06-28T12:44:53Z","snapshot_observed_at":"2026-08-17T16:45:51.981952Z","submitted_at":"2025-04-24T09:53:49Z","title":"Super Co-alignment of Human and AI for Sustainable Symbiotic Society","version":5},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T10:44:03.024403Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2504.17404"},"observation_digest":"sha256:1cdf00b00892797ea5f3bdd9f0589cd26e16d9b57788033b3313f6086dd3df73","observation_id":"7021e217-d75d-4008-9632-7b58aab47b41","resolution":{"observed_at":"2026-08-16T10:44:03.024403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-08-16T06:04:14.579837Z","title":"Prover-verifier games improve legibility of llm outputs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19162","last_updated":"2025-05-17T14:32:38Z","snapshot_observed_at":"2026-08-17T00:05:00.684117Z","submitted_at":"2025-04-27T08:45:06Z","title":"SPC: Evolving Self-Play Critic via Adversarial Games for LLM Reasoning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T06:04:14.579837Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2504.19162"},"observation_digest":"sha256:e081fe0d39dd7c690c1905563ec85438b514166103cde800827cdf23cd152aa8","observation_id":"659adce1-6566-4e18-9750-2302a2330d78","resolution":{"observed_at":"2026-08-16T06:04:14.579837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-08-15T20:08:16.683222Z","title":"Prover-verifier games improve legibility of LLM outputs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13609","last_updated":"2026-07-21T18:13:56Z","snapshot_observed_at":"2026-08-18T03:48:06.454732Z","submitted_at":"2025-06-16T15:37:33Z","title":"Avoiding Obfuscation with Prover-Estimator Debate","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T20:08:16.683222Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2506.13609"},"observation_digest":"sha256:d9a788325702675635061fa83964c988edd14d441cd23e7c6d4171cd533822c9","observation_id":"8ad4fab8-8452-43ab-a9f0-7cf0cddcab99","resolution":{"observed_at":"2026-08-15T20:08:16.683222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-08-15T19:25:57.657405Z","title":"Prover-verifier games improve legibility of llm outputs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.16639","last_updated":"2025-06-19T22:41:43Z","snapshot_observed_at":"2026-08-18T10:10:59.113333Z","submitted_at":"2025-06-19T22:41:43Z","title":"LLM-based Satisfiability Checking of String Requirements by Consistent Data and Checker Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T19:25:57.657405Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2506.16639"},"observation_digest":"sha256:a9859aa19bdc8cb90b30ae968f3e96c5db3589507d0d272fccc85a2214eb5707","observation_id":"0b0534e7-b856-43aa-b0b0-9fd5f27d555e","resolution":{"observed_at":"2026-08-15T19:25:57.657405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-08-06T22:03:53.640168Z","title":"H., Chen, Y., Edwards, H., Leike, J., McAleese, N., and Burda, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22777","last_updated":"2025-07-13T15:36:35Z","snapshot_observed_at":"2026-08-17T01:23:04.052232Z","submitted_at":"2025-06-28T06:37:10Z","title":"Teaching Models to Verbalize Reward Hacking in Chain-of-Thought Reasoning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T22:03:53.640168Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2506.22777"},"observation_digest":"sha256:e8700fe7f921852719768dbd6085f69a0116c705969a1543fa264104c712210f","observation_id":"dfcd6065-a185-47b4-a818-df84799aadc4","resolution":{"observed_at":"2026-08-06T22:03:53.640168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-08-06T18:45:20.543584Z","title":"H., Chen, Y., Edwards, H., Leike, J., McAleese, N., and Burda, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07532","last_updated":"2026-06-19T16:08:31Z","snapshot_observed_at":"2026-08-13T14:10:25.451478Z","submitted_at":"2025-07-10T08:28:46Z","title":"Neural Concept Verifier: Scaling Prover-Verifier Games via Concept Encodings","version":4},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T18:45:20.543584Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2507.07532"},"observation_digest":"sha256:6aadda010bb4fa7a14c7a0de1adb52687041d5e637c5b50771346e39b95273b1","observation_id":"8eb5e0ad-0ef1-4c1b-830d-8f10ccc8518d","resolution":{"observed_at":"2026-08-06T18:45:20.543584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-08-06T04:35:31.176661Z","title":"H.; Chen, Y.; Edwards, H.; Leike, J.; McAleese, N.; and Burda, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.03396","last_updated":"2025-08-05T12:45:21Z","snapshot_observed_at":"2026-08-15T23:26:05.642874Z","submitted_at":"2025-08-05T12:45:21Z","title":"Hide and Seek with LLMs: An Adversarial Game for Sneaky Error Generation and Self-Improving Diagnosis","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T04:35:31.176661Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2508.03396"},"observation_digest":"sha256:2769b68a13c9785b171b6b0d7045f177860cccb636367c8b312eb0858c708607","observation_id":"915c15dc-8988-4842-9e87-dd6f040bed42","resolution":{"observed_at":"2026-08-06T04:35:31.176661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-08-04T20:24:40.586175Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08653","last_updated":"2025-09-11T11:18:17Z","snapshot_observed_at":"2026-08-16T10:46:59.090508Z","submitted_at":"2025-09-10T14:49:12Z","title":"Generative Data Refinement: Just Ask for Better Data","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T20:24:40.586175Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2509.08653"},"observation_digest":"sha256:d8c81a3b77061fe42dd4c0c1596eae0e44a6d09bd57b17e15a721c6f96dce9cd","observation_id":"d7e60f98-5c74-4115-addb-bc760a3e9d56","resolution":{"observed_at":"2026-08-04T20:24:40.586175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-08-04T10:40:45.855435Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.09278","last_updated":"2026-06-28T16:27:56Z","snapshot_observed_at":"2026-08-17T20:34:52.934822Z","submitted_at":"2025-10-10T11:21:09Z","title":"CLARity: Reasoning Consistency Alone Can Teach Reinforced Experts","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T10:40:45.855435Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2510.09278"},"observation_digest":"sha256:a55e845b791f7f1ade10374908bdc971128a00581392d6cae955b7ff9f0f2514","observation_id":"dd420bf7-a3e9-4cb5-bfca-956a24b62bcf","resolution":{"observed_at":"2026-08-04T10:40:45.855435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-08-04T06:40:24.619908Z","title":"Prover- verifier games improve legibility of llm outputs, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.10739","last_updated":"2026-08-03T08:17:50Z","snapshot_observed_at":"2026-08-16T02:54:35.299466Z","submitted_at":"2025-12-11T15:26:28Z","title":"Intern-S1-MO: Long-horizon Reasoning Agent for Olympiad?Level Mathematical Problem Solving","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T06:40:24.619908Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2512.10739"},"observation_digest":"sha256:c790b3e52bceb5d63dd354d611d149fc9e54c5c94d6bf7617290558a1cea124c","observation_id":"2ebcdcce-ecc9-4caa-a902-5544966723a6","resolution":{"observed_at":"2026-08-04T06:40:24.619908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":"2407.13692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-07-09T02:35:53.846004Z","title":"Prover-verifier games improve legibility of llm outputs","venue":"cs.CL","work_id":"2bebdadc-2df7-4816-93c8-70252a1645eb","year":2024},"citing_paper":{"arxiv_id":"2605.10810","last_updated":"2026-05-15T15:01:38Z","snapshot_observed_at":"2026-08-12T16:29:47.459756Z","submitted_at":"2026-05-11T16:32:06Z","title":"Likelihood scoring for continuations of mathematical text: a self-supervised benchmark with tests for shortcut vulnerabilities","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-19T17:20:39.969447Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2605.10810"},"observation_digest":"sha256:bf9c14a05ec67b17e14aba9d1acfd2857b5acd2780d54a71f29f3ae2b721c37e","observation_id":"6cbfbf02-1ba1-421c-8ad5-e79267653787","resolution":{"observed_at":"2026-05-19T17:22:41.910605Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":"2407.13692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-07-09T02:35:53.846004Z","title":"Prover-verifier games improve legibility of llm outputs","venue":"cs.CL","work_id":"2bebdadc-2df7-4816-93c8-70252a1645eb","year":2024},"citing_paper":{"arxiv_id":"2605.13875","last_updated":"2026-05-08T06:56:35Z","snapshot_observed_at":"2026-08-02T22:27:33.584660Z","submitted_at":"2026-05-08T06:56:35Z","title":"Common-agency Games for Multi-Objective Test-Time Alignment","version":1},"reference_index":207,"source":"arxiv_source","source_observed_at":"2026-05-15T06:14:53.685486Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2605.13875"},"observation_digest":"sha256:d6057995f092b6aaeca6519403e8455064573dc04ca24285590166bd24e82a9c","observation_id":"bcb551a3-b855-4e4e-9dae-c62884f40027","resolution":{"observed_at":"2026-05-15T06:15:06.609300Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":"2407.13692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-07-09T02:35:53.846004Z","title":"Prover-verifier games improve legibility of llm outputs","venue":"cs.CL","work_id":"2bebdadc-2df7-4816-93c8-70252a1645eb","year":2024},"citing_paper":{"arxiv_id":"2605.20531","last_updated":"2026-06-17T20:49:55Z","snapshot_observed_at":"2026-08-02T23:01:03.272596Z","submitted_at":"2026-05-19T22:08:51Z","title":"Pseudo-Formalization for Automatic Proof Verification","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-21T06:25:01.098420Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2605.20531"},"observation_digest":"sha256:492ba3312b451894d4c8ecf7f33b4eda2ddb0a3324ddda8010cbe2c4b2ca95df","observation_id":"73b2c4d2-505e-4f9e-8d24-21604c1b170c","resolution":{"observed_at":"2026-05-21T06:29:42.234417Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":"2407.13692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-07-09T02:35:53.846004Z","title":"Prover-verifier games improve legibility of llm outputs","venue":"cs.CL","work_id":"2bebdadc-2df7-4816-93c8-70252a1645eb","year":2024},"citing_paper":{"arxiv_id":"2605.20531","last_updated":"2026-06-17T20:49:55Z","snapshot_observed_at":"2026-08-02T23:01:03.272596Z","submitted_at":"2026-05-19T22:08:51Z","title":"Pseudo-Formalization for Automatic Proof Verification","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T17:17:48.969969Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2605.20531"},"observation_digest":"sha256:9c29af40d16cc2145709d0c4242f477d016f1d26a63473d0c461cf9652042526","observation_id":"1b043fc1-21d6-4cfc-bff1-08db1ed04fdb","resolution":{"observed_at":"2026-06-30T17:24:57.725305Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":"2407.13692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-07-09T02:35:53.846004Z","title":"Prover-verifier games improve legibility of llm outputs","venue":"cs.CL","work_id":"2bebdadc-2df7-4816-93c8-70252a1645eb","year":2024},"citing_paper":{"arxiv_id":"2605.22211","last_updated":"2026-05-21T09:16:27Z","snapshot_observed_at":"2026-08-18T03:40:36.468902Z","submitted_at":"2026-05-21T09:16:27Z","title":"CLORE: Content-Level Optimization for Reasoning Efficiency","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-22T05:50:23.111591Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2605.22211"},"observation_digest":"sha256:1ba0ae55ca16c77eae908391e840549cc12f07470e010979f4a7ed10a2f34cd3","observation_id":"dbe2568e-3262-41ea-9660-a72c084b39ed","resolution":{"observed_at":"2026-05-22T05:51:08.304679Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":"2407.13692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-07-09T02:35:53.846004Z","title":"Prover-verifier games improve legibility of llm outputs","venue":"cs.CL","work_id":"2bebdadc-2df7-4816-93c8-70252a1645eb","year":2024},"citing_paper":{"arxiv_id":"2605.27914","last_updated":"2026-06-09T02:24:01Z","snapshot_observed_at":"2026-07-06T23:37:36.244456Z","submitted_at":"2026-05-27T03:41:11Z","title":"Does Capability Transfer to Subjective Behavior -- and Would Our Instruments Tell Us? A Self-Evolving, Trust-by-Construction Evaluation Paradigm","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-29T12:54:36.818698Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2605.27914"},"observation_digest":"sha256:269ba432de8963e2dff6276b32230a373721fadfc39e441c63e5353f4cec6a7f","observation_id":"f94fca0a-cf0b-4d0c-b59b-0a03c2161c5a","resolution":{"observed_at":"2026-06-29T13:03:26.762455Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":"2407.13692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-07-09T02:35:53.846004Z","title":"Prover-verifier games improve legibility of llm outputs","venue":"cs.CL","work_id":"2bebdadc-2df7-4816-93c8-70252a1645eb","year":2024},"citing_paper":{"arxiv_id":"2605.28807","last_updated":"2026-05-27T17:56:47Z","snapshot_observed_at":"2026-08-17T20:00:37.644447Z","submitted_at":"2026-05-27T17:56:47Z","title":"Calibrating Conservatism for Scalable Oversight","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T11:35:38.988339Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2605.28807"},"observation_digest":"sha256:81e90fcda1946df8f5e49fa3c7e01295417270d30b52b2180e9ba285ae8d47aa","observation_id":"701c8aad-89f6-41f3-a3c6-8f3ec5342b57","resolution":{"observed_at":"2026-06-29T12:13:27.494748Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":"2407.13692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-07-09T02:35:53.846004Z","title":"Prover-verifier games improve legibility of llm outputs","venue":"cs.CL","work_id":"2bebdadc-2df7-4816-93c8-70252a1645eb","year":2024},"citing_paper":{"arxiv_id":"2605.30290","last_updated":"2026-05-31T05:24:16Z","snapshot_observed_at":"2026-08-13T14:51:28.394182Z","submitted_at":"2026-05-28T17:40:45Z","title":"Self-Trained Verification for Training- and Test-Time Self-Improvement","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T08:25:11.645196Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2605.30290"},"observation_digest":"sha256:532d77b739721cb226dfdfdb9ae3a8f902cfa3ab34bd57a0ed3f013f79f37da8","observation_id":"941301f9-2784-45ea-9de1-c6641362f0b3","resolution":{"observed_at":"2026-06-29T08:33:15.743543Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":"2407.13692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-07-09T02:35:53.846004Z","title":"Prover-verifier games improve legibility of llm outputs","venue":"cs.CL","work_id":"2bebdadc-2df7-4816-93c8-70252a1645eb","year":2024},"citing_paper":{"arxiv_id":"2606.00424","last_updated":"2026-05-29T23:21:48Z","snapshot_observed_at":"2026-08-12T22:21:28.885802Z","submitted_at":"2026-05-29T23:21:48Z","title":"Weak Critics Make Strong Learners: On-Policy Critique Distillation for Scalable Oversight","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T21:55:58.645062Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2606.00424"},"observation_digest":"sha256:a3c243a5f31e30b7edc470d5a954638d8a21965d0d1768ce4f4c0c4547bc2202","observation_id":"6759c5cf-cea0-4926-a077-1d1a4f8fdbc5","resolution":{"observed_at":"2026-07-01T19:56:10.986127Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":"2407.13692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-07-09T02:35:53.846004Z","title":"Prover-verifier games improve legibility of llm outputs","venue":"cs.CL","work_id":"2bebdadc-2df7-4816-93c8-70252a1645eb","year":2024},"citing_paper":{"arxiv_id":"2606.09711","last_updated":"2026-06-08T16:32:54Z","snapshot_observed_at":"2026-07-06T23:49:03.237958Z","submitted_at":"2026-06-08T16:32:54Z","title":"Proxy Reward Internalization and Mechanistic Exploitation: A Learned Precursor to Reward Hacking and Its Generalization","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-06-27T16:26:34.918099Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2606.09711"},"observation_digest":"sha256:d59fde0ee783581b21a67ec5bcb3fc21cb45ad3c99c26a908b83cb460e6d148c","observation_id":"b9ba41ea-7bbb-49d6-a5ce-21009dce10a8","resolution":{"observed_at":"2026-07-03T01:37:30.546173Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":"2407.13692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-07-09T02:35:53.846004Z","title":"Prover-verifier games improve legibility of llm outputs","venue":"cs.CL","work_id":"2bebdadc-2df7-4816-93c8-70252a1645eb","year":2024},"citing_paper":{"arxiv_id":"2606.10684","last_updated":"2026-06-09T10:40:55Z","snapshot_observed_at":"2026-08-16T22:54:38.424124Z","submitted_at":"2026-06-09T10:40:55Z","title":"Divide and Cooperate: Role-Decomposed Multi-Agent LLM Training with Cross-Agent Learning Signals","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T14:23:06.932530Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2606.10684"},"observation_digest":"sha256:021a648e57ed449ce5dbe01d266928c8dc4ed362fde4c4f65a47799d275413f9","observation_id":"bc76dda3-e66e-41be-9ac3-7dbc912fe5ba","resolution":{"observed_at":"2026-07-03T03:57:38.332218Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":"2407.13692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-07-09T02:35:53.846004Z","title":"Prover-verifier games improve legibility of llm outputs","venue":"cs.CL","work_id":"2bebdadc-2df7-4816-93c8-70252a1645eb","year":2024},"citing_paper":{"arxiv_id":"2606.28166","last_updated":"2026-06-26T15:00:35Z","snapshot_observed_at":"2026-08-14T16:13:24.812823Z","submitted_at":"2026-06-26T15:00:35Z","title":"Tandem Reinforcement Learning with Verifiable Rewards","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T03:56:06.424420Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2606.28166"},"observation_digest":"sha256:3bf21744ad4b00245aed056efffaf1ac94e978117d470d63e9d2a3e835cd72a6","observation_id":"772bc73e-6b95-43bd-8747-a2f0d62e1c51","resolution":{"observed_at":"2026-07-01T17:15:51.809242Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":"2407.13692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-07-09T02:35:53.846004Z","title":"Prover-verifier games improve legibility of llm outputs","venue":"cs.CL","work_id":"2bebdadc-2df7-4816-93c8-70252a1645eb","year":2024},"citing_paper":{"arxiv_id":"2606.31748","last_updated":"2026-06-30T14:38:49Z","snapshot_observed_at":"2026-07-07T00:05:27.130060Z","submitted_at":"2026-06-30T14:38:49Z","title":"Addressing Over-Refusal in LLMs with Competing Rewards","version":1},"reference_index":104,"source":"arxiv_source","source_observed_at":"2026-07-01T06:59:12.695984Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2606.31748"},"observation_digest":"sha256:6b288c37f50b2d8bf49f3c671a58f4d6d736bce8703c0a1e3983c18a2ee830e1","observation_id":"8b02d299-2215-4dbb-a74b-dbea5896c1fc","resolution":{"observed_at":"2026-07-01T08:55:35.512114Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":"2407.13692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-07-09T02:35:53.846004Z","title":"Prover-verifier games improve legibility of llm outputs","venue":"cs.CL","work_id":"2bebdadc-2df7-4816-93c8-70252a1645eb","year":2024},"citing_paper":{"arxiv_id":"2607.01223","last_updated":"2026-07-01T17:56:42Z","snapshot_observed_at":"2026-08-16T02:21:36.215481Z","submitted_at":"2026-07-01T17:56:42Z","title":"Theoria: Rewrite-Acceptability Verification over Informal Reasoning States","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-02T12:12:20.879377Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2607.01223"},"observation_digest":"sha256:d6f128cfa424cb3a57128b8ffdf2822d2559fb25f68dab5da89329f27b678180","observation_id":"07ce9284-9608-4c9c-b33a-807814cc0f53","resolution":{"observed_at":"2026-07-02T12:16:56.400741Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-07-12T01:34:45.323277Z","title":"arXiv preprint arXiv:2407.13692 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03561","last_updated":"2026-07-03T18:49:20Z","snapshot_observed_at":"2026-08-14T03:24:41.529429Z","submitted_at":"2026-07-03T18:49:20Z","title":"How to Avoid Debate: Scalable AI Safety via Doubly-Efficient Interactive Proofs","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-12T01:34:45.323277Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2607.03561"},"observation_digest":"sha256:dcc3b58a83a60aefd05e521655ca9f377e0f044a86cd287bfebd45e4bebaedf9","observation_id":"c6bb3969-3f35-4845-9ea6-b0113ad472b7","resolution":{"observed_at":"2026-07-12T01:34:45.323277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":"2407.13692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-07-09T02:35:53.846004Z","title":"Prover-verifier games improve legibility of llm outputs","venue":"cs.CL","work_id":"2bebdadc-2df7-4816-93c8-70252a1645eb","year":2024},"citing_paper":{"arxiv_id":"2607.07690","last_updated":"2026-07-08T17:49:14Z","snapshot_observed_at":"2026-08-18T00:47:39.478171Z","submitted_at":"2026-07-08T17:49:14Z","title":"Agon: Competitive Cross-Model RL with Implicit Rival Grading of Reasoning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-09T02:29:12.366018Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2607.07690"},"observation_digest":"sha256:62defa8c09d4afd60866ae9b1a3f064ccbdf18a3ad13b9d52de53a68b598d697","observation_id":"4b1b1f36-2229-4363-8bad-ee62b3ab3fd7","resolution":{"observed_at":"2026-07-09T02:35:53.847137Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-08-01T09:12:27.567392Z","title":"arXiv preprint arXiv:2407.13692 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20852","last_updated":"2026-07-23T02:23:09Z","snapshot_observed_at":"2026-08-17T00:49:48.313896Z","submitted_at":"2026-07-23T02:23:09Z","title":"Code Monitor Red Teaming for Public-Test-Passing Code","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-01T09:12:27.567392Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2607.20852"},"observation_digest":"sha256:d49b0820823215bec263aa7345a48065b1ca72447db42847f9827bd8c2802c04","observation_id":"22009a97-3e77-4fca-9d92-4d68e232891c","resolution":{"observed_at":"2026-08-01T09:12:27.567392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-08-12T04:42:44.284985Z","title":"Prover-verifier games improve legibility of LLM outputs.CoRR, abs/2407.13692,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11181","last_updated":"2026-08-11T17:41:39Z","snapshot_observed_at":"2026-08-14T23:12:40.054266Z","submitted_at":"2026-08-11T17:41:39Z","title":"How to Verify Consistency of Probabilistic Claims","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-12T04:42:44.284985Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2608.11181"},"observation_digest":"sha256:78754c948ad102f6d6c0529a9daf52b24e736632ff2769cf98a333a766695218","observation_id":"3e75ddd2-516b-426c-b4c3-557b19d4870f","resolution":{"observed_at":"2026-08-12T04:42:44.284985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2407.13692/citation-record","integrity":"/paper/2407.13692/integrity","json":"/paper/2407.13692/citation-record.json","paper":"/paper/2407.13692"},"outbound":[],"paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 34 inbound Pith citation observations for arXiv:2407.13692."}