{"as_of":"2026-08-20T00:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e23327f64516d7a8af8f641fc00816050d8cc46bf011c029d7e8392f388ea4b7","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-08T21:20:07.569587Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T05:30:04.547511Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.05904","last_updated":"2026-07-07T06:59:30Z","snapshot_observed_at":"2026-08-15T07:14:25.601844Z","submitted_at":"2026-07-07T06:59:30Z","title":"More Convincing, Not More Correct: Self-Play Reward Hacking of Reference-Free LLM Judges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.05904","snapshot_observed_at":"2026-07-14T07:36:47.336670Z","title":"More convincing, not more correct: Self-play reward hacking of reference-free LLM judges.arXiv preprint arXiv:2607.05904,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11022","last_updated":"2026-07-13T02:41:16Z","snapshot_observed_at":"2026-08-18T03:01:18.756974Z","submitted_at":"2026-07-13T02:41:16Z","title":"When the Reward Suite Is Leaky: A Preregistered Causal Contrast of Natural Verifier False Positives in RLVR","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-14T07:36:47.336670Z"},"links":{"cited_paper":"/paper/2607.05904","citing_paper":"/paper/2607.11022"},"observation_digest":"sha256:5c8f68c3dedcdcb622be3be276b0cd2a9a493c8763316b32cd3339fd797b64c7","observation_id":"6ae011a9-146e-4fe1-beee-c62444a77711","resolution":{"observed_at":"2026-07-14T07:36:47.336670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.05904","last_updated":"2026-07-07T06:59:30Z","snapshot_observed_at":"2026-08-15T07:14:25.601844Z","submitted_at":"2026-07-07T06:59:30Z","title":"More Convincing, Not More Correct: Self-Play Reward Hacking of Reference-Free LLM Judges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.05904","snapshot_observed_at":"2026-08-02T05:30:04.547511Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:04.547511Z"},"links":{"cited_paper":"/paper/2607.05904","citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:fb3b426bfe3e97bd9e7e99b6e6f28dbadcc923feb5919d86dfecebfe63a356eb","observation_id":"c00c37c5-f72f-4540-aa54-4c93eb9684bd","resolution":{"observed_at":"2026-08-02T05:30:04.547511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.05904/citation-record","integrity":"/paper/2607.05904/integrity","json":"/paper/2607.05904/citation-record.json","paper":"/paper/2607.05904"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-16T03:49:00.703994Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":"2212.08073","doi":"10.48550/arxiv.2212.08073","metadata_source":"pith","pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Constitutional AI: Harmlessness from AI Feedback","venue":"cs.CL","work_id":"faaaa4e0-2676-4fac-a0b4-99aef10d2095","year":2022},"citing_paper":{"arxiv_id":"2607.05904","last_updated":"2026-07-07T06:59:30Z","snapshot_observed_at":"2026-08-15T07:14:25.601844Z","submitted_at":"2026-07-07T06:59:30Z","title":"More Convincing, Not More Correct: Self-Play Reward Hacking of Reference-Free LLM Judges","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-08T21:20:07.569587Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2607.05904"},"observation_digest":"sha256:59256c32db2143960293e322a9fc10c00ddb429fb9c60a767c19545e4dd8a4c2","observation_id":"506e4a48-45dd-4232-bdb2-632c0437beae","resolution":{"observed_at":"2026-07-08T21:25:38.646181Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-15T03:08:13.900899+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-15T03:08:13.900899+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01335","last_updated":"2024-06-14T21:17:17Z","snapshot_observed_at":"2026-08-19T08:48:56.371619Z","submitted_at":"2024-01-02T18:53:13Z","title":"Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models","version":3},"cited_work":{"arxiv_id":"2401.01335","doi":"10.48550/arxiv.2401.01335","metadata_source":"pith","pith_arxiv_id":"2401.01335","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models","venue":"cs.LG","work_id":"6b7f0773-4e99-4274-9d8e-279a1f25c5e1","year":2024},"citing_paper":{"arxiv_id":"2607.05904","last_updated":"2026-07-07T06:59:30Z","snapshot_observed_at":"2026-08-15T07:14:25.601844Z","submitted_at":"2026-07-07T06:59:30Z","title":"More Convincing, Not More Correct: Self-Play Reward Hacking of Reference-Free LLM Judges","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-08T21:20:07.569587Z"},"links":{"cited_paper":"/paper/2401.01335","citing_paper":"/paper/2607.05904"},"observation_digest":"sha256:be4292d7e46aca7d7e0599e0962795dbc73dcf67d15ab39e7a9f21e5687d3a08","observation_id":"a2a38675-5ead-4f4a-89e7-1e1b34693671","resolution":{"observed_at":"2026-07-08T21:25:38.654700Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02743","last_updated":"2024-03-10T16:14:58Z","snapshot_observed_at":"2026-08-19T21:21:24.687697Z","submitted_at":"2023-10-04T11:34:22Z","title":"Reward Model Ensembles Help Mitigate Overoptimization","version":2},"cited_work":{"arxiv_id":"2310.02743","doi":"10.48550/arxiv.2310.02743","metadata_source":"pith","pith_arxiv_id":"2310.02743","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reward Model Ensembles Help Mitigate Overoptimization , March 2024","venue":"cs.LG","work_id":"676cee74-bbbe-4612-a3a9-87676dd3a6a3","year":2023},"citing_paper":{"arxiv_id":"2607.05904","last_updated":"2026-07-07T06:59:30Z","snapshot_observed_at":"2026-08-15T07:14:25.601844Z","submitted_at":"2026-07-07T06:59:30Z","title":"More Convincing, Not More Correct: Self-Play Reward Hacking of Reference-Free LLM Judges","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-08T21:20:07.569587Z"},"links":{"cited_paper":"/paper/2310.02743","citing_paper":"/paper/2607.05904"},"observation_digest":"sha256:50bafb88eac1ff10f018fa73118ba19b7fc0bd7ab1d94508eb877ed1866618c4","observation_id":"e426a20c-f573-4c4b-a2db-4c6fccabcff7","resolution":{"observed_at":"2026-07-08T21:25:38.636176Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-22T21:23:20.66747+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T21:23:20.66747+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.10760","last_updated":"2022-10-19T17:56:10Z","snapshot_observed_at":"2026-07-06T14:07:50.468967Z","submitted_at":"2022-10-19T17:56:10Z","title":"Scaling Laws for Reward Model Overoptimization","version":1},"cited_work":{"arxiv_id":"2210.10760","doi":"10.48550/arxiv.2210.10760","metadata_source":"pith","pith_arxiv_id":"2210.10760","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Laws for Reward Model Overoptimization","venue":"cs.LG","work_id":"0fb09554-8ce6-4366-8b78-f426e318fcfd","year":2022},"citing_paper":{"arxiv_id":"2607.05904","last_updated":"2026-07-07T06:59:30Z","snapshot_observed_at":"2026-08-15T07:14:25.601844Z","submitted_at":"2026-07-07T06:59:30Z","title":"More Convincing, Not More Correct: Self-Play Reward Hacking of Reference-Free LLM Judges","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-08T21:20:07.569587Z"},"links":{"cited_paper":"/paper/2210.10760","citing_paper":"/paper/2607.05904"},"observation_digest":"sha256:03be55719f8be7c2692e4dd6220412a3adffda303f15a6bf2d9251ff69989f85","observation_id":"6539054c-9dac-4621-b592-f3be852adeb6","resolution":{"observed_at":"2026-07-08T21:25:38.660138Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-17T17:38:14.286957+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T17:38:14.286957+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04622","last_updated":"2024-07-12T16:38:12Z","snapshot_observed_at":"2026-08-16T13:36:46.681429Z","submitted_at":"2024-07-05T16:29:15Z","title":"On scalable oversight with weak LLMs judging strong LLMs","version":2},"cited_work":{"arxiv_id":"2407.04622","doi":"10.48550/arxiv.2407.04622","metadata_source":"pith","pith_arxiv_id":"2407.04622","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Siegel, János Kramár, Jonah Brown-Cohen, Samuel Albanie, Jannis Bulian, Rishabh Agarwal, David Lindner, Yunhao Tang, Noah D","venue":"cs.LG","work_id":"a04390e1-d3d7-43e4-87d0-2c6b25780063","year":2024},"citing_paper":{"arxiv_id":"2607.05904","last_updated":"2026-07-07T06:59:30Z","snapshot_observed_at":"2026-08-15T07:14:25.601844Z","submitted_at":"2026-07-07T06:59:30Z","title":"More Convincing, Not More Correct: Self-Play Reward Hacking of Reference-Free LLM Judges","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-08T21:20:07.569587Z"},"links":{"cited_paper":"/paper/2407.04622","citing_paper":"/paper/2607.05904"},"observation_digest":"sha256:9bb49334e6752c1deaa7cdb5abd3956177c8d94cfadae9825a8ef509b0b84e7f","observation_id":"5f5cc307-ba46-4aab-bcad-d2edb1acc691","resolution":{"observed_at":"2026-07-08T21:25:38.643507Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.02304","last_updated":"2026-04-21T03:02:32Z","snapshot_observed_at":"2026-08-15T14:50:43.984376Z","submitted_at":"2025-12-02T00:51:14Z","title":"When Does Verification Pay Off? A Closer Look at LLMs as Solution Verifiers","version":2},"cited_work":{"arxiv_id":"2512.02304","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.02304","snapshot_observed_at":"2026-07-08T21:25:38.632339Z","title":"When Does Verification Pay Off? A Closer Look at LLMs as Solution Verifiers","venue":"cs.CL","work_id":"c784d7d9-7d49-474b-b5e4-7509dd23c25b","year":2025},"citing_paper":{"arxiv_id":"2607.05904","last_updated":"2026-07-07T06:59:30Z","snapshot_observed_at":"2026-08-15T07:14:25.601844Z","submitted_at":"2026-07-07T06:59:30Z","title":"More Convincing, Not More Correct: Self-Play Reward Hacking of Reference-Free LLM Judges","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-08T21:20:07.569587Z"},"links":{"cited_paper":"/paper/2512.02304","citing_paper":"/paper/2607.05904"},"observation_digest":"sha256:28aa517afab57e345bad85c2238c47ef951f72697ea0cea8d106d185ec7ccf6a","observation_id":"3aa99a92-a834-4240-aaea-2d299ae90004","resolution":{"observed_at":"2026-07-08T21:25:38.633754Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04549","last_updated":"2024-07-05T14:34:50Z","snapshot_observed_at":"2026-08-16T13:36:45.837914Z","submitted_at":"2024-07-05T14:34:50Z","title":"Spontaneous Reward Hacking in Iterative Self-Refinement","version":1},"cited_work":{"arxiv_id":"2407.04549","doi":"10.48550/arxiv.2407.04549","metadata_source":"pith","pith_arxiv_id":"2407.04549","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Spontaneous reward hacking in iterative self-refinement","venue":"cs.CL","work_id":"7be47fce-249a-4aac-9729-48bcaf92cf35","year":2024},"citing_paper":{"arxiv_id":"2607.05904","last_updated":"2026-07-07T06:59:30Z","snapshot_observed_at":"2026-08-15T07:14:25.601844Z","submitted_at":"2026-07-07T06:59:30Z","title":"More Convincing, Not More Correct: Self-Play Reward Hacking of Reference-Free LLM Judges","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-08T21:20:07.569587Z"},"links":{"cited_paper":"/paper/2407.04549","citing_paper":"/paper/2607.05904"},"observation_digest":"sha256:e02c3e373c88369a7f789943494d5f6d2f819d1c7e3681330891518982d7787c","observation_id":"69d997df-802e-42d1-aafe-6cd36dd11edf","resolution":{"observed_at":"2026-07-08T21:25:38.621167Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02900","last_updated":"2024-11-05T01:44:14Z","snapshot_observed_at":"2026-08-16T14:02:09.339561Z","submitted_at":"2024-06-05T03:41:37Z","title":"Scaling Laws for Reward Model Overoptimization in Direct Alignment Algorithms","version":2},"cited_work":{"arxiv_id":"2406.02900","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.02900","snapshot_observed_at":"2026-07-08T21:25:38.650008Z","title":"B., Finn, C., and Niekum, S","venue":"cs.LG","work_id":"f959e0ed-a9df-409e-a8db-ec3d23671531","year":2024},"citing_paper":{"arxiv_id":"2607.05904","last_updated":"2026-07-07T06:59:30Z","snapshot_observed_at":"2026-08-15T07:14:25.601844Z","submitted_at":"2026-07-07T06:59:30Z","title":"More Convincing, Not More Correct: Self-Play Reward Hacking of Reference-Free LLM Judges","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-08T21:20:07.569587Z"},"links":{"cited_paper":"/paper/2406.02900","citing_paper":"/paper/2607.05904"},"observation_digest":"sha256:84873513c5225b462e37907a75320252c078ddb13f8e8c2eaff1cbfa00f8293f","observation_id":"c8f2e35b-8718-4d47-a563-965679ca8cff","resolution":{"observed_at":"2026-07-08T21:25:38.651895Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13548","last_updated":"2025-05-10T07:10:46Z","snapshot_observed_at":"2026-08-14T16:46:25.561386Z","submitted_at":"2023-10-20T14:46:48Z","title":"Towards Understanding Sycophancy in Language Models","version":4},"cited_work":{"arxiv_id":"2310.13548","doi":"10.48550/arxiv.2310.13548","metadata_source":"pith","pith_arxiv_id":"2310.13548","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards Understanding Sycophancy in Language Models","venue":"cs.CL","work_id":"aeefec9a-6ad5-4743-92b9-de6983895e21","year":2023},"citing_paper":{"arxiv_id":"2607.05904","last_updated":"2026-07-07T06:59:30Z","snapshot_observed_at":"2026-08-15T07:14:25.601844Z","submitted_at":"2026-07-07T06:59:30Z","title":"More Convincing, Not More Correct: Self-Play Reward Hacking of Reference-Free LLM Judges","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-08T21:20:07.569587Z"},"links":{"cited_paper":"/paper/2310.13548","citing_paper":"/paper/2607.05904"},"observation_digest":"sha256:e1c024a9310eca2e75b98a57d250718187d3476166764495108681d3b9a115e9","observation_id":"bb7db7e6-05e1-4192-86a6-93676208df0a","resolution":{"observed_at":"2026-07-08T21:25:38.623673Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-12T14:50:19.716954+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T14:50:19.716954+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08827","last_updated":"2025-08-06T23:51:16Z","snapshot_observed_at":"2026-08-19T20:41:21.169086Z","submitted_at":"2025-05-12T23:51:04Z","title":"RLSR: Reinforcement Learning from Self Reward","version":2},"cited_work":{"arxiv_id":"2505.08827","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.08827","snapshot_observed_at":"2026-07-08T21:25:38.647436Z","title":"Omkar Thawakar, Dinura Dissanayake, Ketan More, Ritesh Thawkar, Ahmed Heakl, Noor Ahsan, Yuhao Li, Mohammed Zumri, Jean Lahoud, Rao Muhammad Anwer, et al","venue":"cs.LG","work_id":"456391de-7d99-4030-bc68-6b40bd8f35ff","year":2025},"citing_paper":{"arxiv_id":"2607.05904","last_updated":"2026-07-07T06:59:30Z","snapshot_observed_at":"2026-08-15T07:14:25.601844Z","submitted_at":"2026-07-07T06:59:30Z","title":"More Convincing, Not More Correct: Self-Play Reward Hacking of Reference-Free LLM Judges","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-08T21:20:07.569587Z"},"links":{"cited_paper":"/paper/2505.08827","citing_paper":"/paper/2607.05904"},"observation_digest":"sha256:74fe9469157e60a2b2a511b43beb8cb51d947a9d658b4f55e41a13472bf0c985","observation_id":"74981873-42cf-49ce-8db6-a0512b782060","resolution":{"observed_at":"2026-07-08T21:25:38.648851Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03716","last_updated":"2024-07-10T23:15:49Z","snapshot_observed_at":"2026-08-19T22:58:18.659240Z","submitted_at":"2023-10-05T17:38:28Z","title":"A Long Way to Go: Investigating Length Correlations in RLHF","version":2},"cited_work":{"arxiv_id":"2310.03716","doi":"10.48550/arxiv.2310.03716","metadata_source":"pith","pith_arxiv_id":"2310.03716","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A long way to go: Investigating length correlations in rlhf","venue":"cs.CL","work_id":"23d0dfe6-c919-4498-8696-1e298c7834e9","year":2023},"citing_paper":{"arxiv_id":"2607.05904","last_updated":"2026-07-07T06:59:30Z","snapshot_observed_at":"2026-08-15T07:14:25.601844Z","submitted_at":"2026-07-07T06:59:30Z","title":"More Convincing, Not More Correct: Self-Play Reward Hacking of Reference-Free LLM Judges","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-08T21:20:07.569587Z"},"links":{"cited_paper":"/paper/2310.03716","citing_paper":"/paper/2607.05904"},"observation_digest":"sha256:9f09e6433f9719f744d2bd89ecb212ff30d79cc8cdfc8d8aa272b2f54a7a5dd3","observation_id":"fad3a143-a4bd-4dc4-9ba6-2eac61ce336e","resolution":{"observed_at":"2026-07-08T21:25:38.638530Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:49:21.130019+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:49:21.130019+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12822","last_updated":"2024-12-08T04:06:53Z","snapshot_observed_at":"2026-08-17T15:42:49.103733Z","submitted_at":"2024-09-19T14:50:34Z","title":"Language Models Learn to Mislead Humans via RLHF","version":3},"cited_work":{"arxiv_id":"2409.12822","doi":"10.48550/arxiv.2409.12822","metadata_source":"pith","pith_arxiv_id":"2409.12822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language models learn to mislead humans via rlhf","venue":"cs.CL","work_id":"4e7ac831-1344-4b1d-910b-7698f7d1c019","year":2024},"citing_paper":{"arxiv_id":"2607.05904","last_updated":"2026-07-07T06:59:30Z","snapshot_observed_at":"2026-08-15T07:14:25.601844Z","submitted_at":"2026-07-07T06:59:30Z","title":"More Convincing, Not More Correct: Self-Play Reward Hacking of Reference-Free LLM Judges","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-08T21:20:07.569587Z"},"links":{"cited_paper":"/paper/2409.12822","citing_paper":"/paper/2607.05904"},"observation_digest":"sha256:f31fe7a62e649d6608a1ac494e139a6632c4473381d6e7d17de6d2e58bc3eaa7","observation_id":"8ecccce0-e3b5-4121-8e76-605d931b0bb1","resolution":{"observed_at":"2026-07-08T21:25:38.626147Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10020","last_updated":"2025-03-28T00:06:51Z","snapshot_observed_at":"2026-08-15T01:20:08.134494Z","submitted_at":"2024-01-18T14:43:47Z","title":"Self-Rewarding Language Models","version":3},"cited_work":{"arxiv_id":"2401.10020","doi":"10.48550/arxiv.2401.10020","metadata_source":"pith","pith_arxiv_id":"2401.10020","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self-Rewarding Language Models","venue":"cs.CL","work_id":"b3903c9e-1bc7-4267-a171-6311902be2a4","year":2024},"citing_paper":{"arxiv_id":"2607.05904","last_updated":"2026-07-07T06:59:30Z","snapshot_observed_at":"2026-08-15T07:14:25.601844Z","submitted_at":"2026-07-07T06:59:30Z","title":"More Convincing, Not More Correct: Self-Play Reward Hacking of Reference-Free LLM Judges","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-08T21:20:07.569587Z"},"links":{"cited_paper":"/paper/2401.10020","citing_paper":"/paper/2607.05904"},"observation_digest":"sha256:998aec2e14e6c1c9d9c6cbd713a7e17df36e91be6d7b2a32d82477385859d4ca","observation_id":"3f3cf442-54df-48bf-9996-6e8ce059e79d","resolution":{"observed_at":"2026-07-08T21:25:38.628686Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-24T14:25:11.326851+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T14:25:11.326851+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15240","last_updated":"2025-02-22T10:21:46Z","snapshot_observed_at":"2026-08-17T07:45:48.419891Z","submitted_at":"2024-08-27T17:57:45Z","title":"Generative Verifiers: Reward Modeling as Next-Token Prediction","version":3},"cited_work":{"arxiv_id":"2408.15240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.15240","snapshot_observed_at":"2026-07-08T21:25:38.629808Z","title":"Generative Verifiers: Reward Modeling as Next-Token Prediction","venue":"cs.LG","work_id":"dbe9c116-8030-4e7c-a259-b52c80846d0e","year":2024},"citing_paper":{"arxiv_id":"2607.05904","last_updated":"2026-07-07T06:59:30Z","snapshot_observed_at":"2026-08-15T07:14:25.601844Z","submitted_at":"2026-07-07T06:59:30Z","title":"More Convincing, Not More Correct: Self-Play Reward Hacking of Reference-Free LLM Judges","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-08T21:20:07.569587Z"},"links":{"cited_paper":"/paper/2408.15240","citing_paper":"/paper/2607.05904"},"observation_digest":"sha256:00e17219b81881fde0663b7ececb289a88758a83e32bf172598fb69b6447f370","observation_id":"673ffde6-90b0-4138-9369-886aaa53056e","resolution":{"observed_at":"2026-07-08T21:25:38.631126Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05685","last_updated":"2023-12-24T02:01:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-09T05:55:52Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","version":4},"cited_work":{"arxiv_id":"2306.05685","doi":"10.1109/4235.797969","metadata_source":"pith","pith_arxiv_id":"2306.05685","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","venue":"cs.CL","work_id":"d0c30cd7-81e1-4159-a87f-f6adca77ff08","year":2023},"citing_paper":{"arxiv_id":"2607.05904","last_updated":"2026-07-07T06:59:30Z","snapshot_observed_at":"2026-08-15T07:14:25.601844Z","submitted_at":"2026-07-07T06:59:30Z","title":"More Convincing, Not More Correct: Self-Play Reward Hacking of Reference-Free LLM Judges","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-08T21:20:07.569587Z"},"links":{"cited_paper":"/paper/2306.05685","citing_paper":"/paper/2607.05904"},"observation_digest":"sha256:97797aeea844298daa7f443439fc506dac7693abd16a5c2676036ec085379c86","observation_id":"23382bfc-ab7b-4f1b-95f5-22557924239b","resolution":{"observed_at":"2026-07-08T21:25:38.657623Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T21:25:38.774998Z","title":"My answer:","venue":null,"work_id":"c34f9c3e-2372-4c67-80df-beb2fd590a8a","year":2024},"citing_paper":{"arxiv_id":"2607.05904","last_updated":"2026-07-07T06:59:30Z","snapshot_observed_at":"2026-08-15T07:14:25.601844Z","submitted_at":"2026-07-07T06:59:30Z","title":"More Convincing, Not More Correct: Self-Play Reward Hacking of Reference-Free LLM Judges","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-08T21:20:07.569587Z"},"links":{"citing_paper":"/paper/2607.05904"},"observation_digest":"sha256:68831ba9961a27914a9f3e0cfc0efaf124f3bd3c73c7e25fdc217512ce7e9c2a","observation_id":"9f584040-5632-4e7d-8caa-742fc0662be9","resolution":{"observed_at":"2026-07-08T21:25:38.776124Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3780.2270","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T21:25:38.639589Z","title":null,"venue":null,"work_id":"36d231fd-f233-46f3-a277-43d89297fd1e","year":1920},"citing_paper":{"arxiv_id":"2607.05904","last_updated":"2026-07-07T06:59:30Z","snapshot_observed_at":"2026-08-15T07:14:25.601844Z","submitted_at":"2026-07-07T06:59:30Z","title":"More Convincing, Not More Correct: Self-Play Reward Hacking of Reference-Free LLM Judges","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-08T21:20:07.569587Z"},"links":{"citing_paper":"/paper/2607.05904"},"observation_digest":"sha256:5b8b8e5c98abf0bcc2cce85105e53d1016130c148b2edacc4634ed1319049074","observation_id":"dd5d18f7-6d21-4e60-851b-7e93d26be757","resolution":{"observed_at":"2026-07-08T21:25:38.640934Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.05904","last_updated":"2026-07-07T06:59:30Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T07:14:25.601844Z","submitted_at":"2026-07-07T06:59:30Z","title":"More Convincing, Not More Correct: Self-Play Reward Hacking of Reference-Free LLM Judges"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":1,"metadata_mismatch":10,"parse_uncertain":0,"unresolved":0,"verified_exact":6,"verified_fuzzy":0},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 2 inbound Pith citation observations for arXiv:2607.05904."}