{"as_of":"2026-08-20T04:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b78ed1f6ee696af91585c798bddc2a978c802c945e544dc446215e9d9cdefd4b","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-09T02:29:12.366018Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.07690/citation-record","integrity":"/paper/2607.07690/integrity","json":"/paper/2607.07690/citation-record.json","paper":"/paper/2607.07690"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.11456","last_updated":"2025-05-22T19:12:14Z","snapshot_observed_at":"2026-08-13T20:36:12.184426Z","submitted_at":"2025-04-15T17:59:51Z","title":"DeepMath-103K: A Large-Scale, Challenging, Decontaminated, and Verifiable Mathematical Dataset for Advancing Reasoning","version":2},"cited_work":{"arxiv_id":"2504.11456","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.11456","snapshot_observed_at":"2026-07-09T03:25:57.840663Z","title":"DeepMath-103K: A Large-Scale, Challenging, Decontaminated, and Verifiable Mathematical Dataset for Advancing Reasoning","venue":"cs.CL","work_id":"3dea79f1-73da-4db2-8d7b-64013c3c5fa5","year":2025},"citing_paper":{"arxiv_id":"2607.07690","last_updated":"2026-07-08T17:49:14Z","snapshot_observed_at":"2026-08-18T00:47:39.478171Z","submitted_at":"2026-07-08T17:49:14Z","title":"Agon: Competitive Cross-Model RL with Implicit Rival Grading of Reasoning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-09T02:29:12.366018Z"},"links":{"cited_paper":"/paper/2504.11456","citing_paper":"/paper/2607.07690"},"observation_digest":"sha256:b48a9cee33e332b5800a416a7b6c3f2382f4d41dd2ef2fdee327323e1aceea06","observation_id":"8b390d5b-bf7a-42a2-b48e-ce75570111dc","resolution":{"observed_at":"2026-07-09T02:35:53.868114Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04697","last_updated":"2025-10-03T01:55:58Z","snapshot_observed_at":"2026-08-17T16:48:59.674177Z","submitted_at":"2025-03-06T18:43:29Z","title":"L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2503.04697","doi":"10.48550/arxiv.2503.04697","metadata_source":"pith","pith_arxiv_id":"2503.04697","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning","venue":"cs.CL","work_id":"ad7236fb-3752-48a9-b782-a384899c45a0","year":2025},"citing_paper":{"arxiv_id":"2607.07690","last_updated":"2026-07-08T17:49:14Z","snapshot_observed_at":"2026-08-18T00:47:39.478171Z","submitted_at":"2026-07-08T17:49:14Z","title":"Agon: Competitive Cross-Model RL with Implicit Rival Grading of Reasoning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-09T02:29:12.366018Z"},"links":{"cited_paper":"/paper/2503.04697","citing_paper":"/paper/2607.07690"},"observation_digest":"sha256:dafc8dc485f41f40abd74eca2e75ebb5b406f882fc66d38505c805b6c0a88745","observation_id":"f0f61310-7bfc-4e5a-98d5-f0c3f2e26e29","resolution":{"observed_at":"2026-07-09T02:35:53.844868Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-17T09:42:34.746112Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":"2305.20050","doi":"10.1007/bf00262952","metadata_source":"pith","pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Let's Verify Step by Step","venue":"cs.LG","work_id":"6d05b790-04c5-4fd2-91b2-ba1dfdd5770f","year":2023},"citing_paper":{"arxiv_id":"2607.07690","last_updated":"2026-07-08T17:49:14Z","snapshot_observed_at":"2026-08-18T00:47:39.478171Z","submitted_at":"2026-07-08T17:49:14Z","title":"Agon: Competitive Cross-Model RL with Implicit Rival Grading of Reasoning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-09T02:29:12.366018Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2607.07690"},"observation_digest":"sha256:c33a87ef383506ab79529e2be8250813cb75cb43bce7341ef288b2054add634f","observation_id":"39e7199e-d52e-42b4-925c-420e2dcb72a1","resolution":{"observed_at":"2026-07-09T02:35:53.870304Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04692","last_updated":"2024-06-07T07:04:10Z","snapshot_observed_at":"2026-08-13T12:11:51.471762Z","submitted_at":"2024-06-07T07:04:10Z","title":"Mixture-of-Agents Enhances Large Language Model Capabilities","version":1},"cited_work":{"arxiv_id":"2406.04692","doi":"10.48550/arxiv.2406.04692","metadata_source":"pith","pith_arxiv_id":"2406.04692","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mixture-of-Agents Enhances Large Language Model Capabilities","venue":"cs.CL","work_id":"3efec870-3e92-4baa-be9f-50e1aa07140f","year":2024},"citing_paper":{"arxiv_id":"2607.07690","last_updated":"2026-07-08T17:49:14Z","snapshot_observed_at":"2026-08-18T00:47:39.478171Z","submitted_at":"2026-07-08T17:49:14Z","title":"Agon: Competitive Cross-Model RL with Implicit Rival Grading of Reasoning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-09T02:29:12.366018Z"},"links":{"cited_paper":"/paper/2406.04692","citing_paper":"/paper/2607.07690"},"observation_digest":"sha256:39960a59be1fd36428afa2a5714f76af726a1b2c4c419c7ce74614cb5a4e69da","observation_id":"6e9aeb06-992a-44be-a519-1256a02baf2c","resolution":{"observed_at":"2026-07-09T02:35:53.865745Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00674","last_updated":"2025-02-02T05:23:29Z","snapshot_observed_at":"2026-08-14T04:50:30.127326Z","submitted_at":"2025-02-02T05:23:29Z","title":"Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?","version":1},"cited_work":{"arxiv_id":"2502.00674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.00674","snapshot_observed_at":"2026-07-09T02:35:53.862220Z","title":"Rethinking mixture-of-agents: Is mixing different large language models beneficial?","venue":"cs.CL","work_id":"c6745a0f-feed-481a-8c8e-4986a80b8afe","year":2025},"citing_paper":{"arxiv_id":"2607.07690","last_updated":"2026-07-08T17:49:14Z","snapshot_observed_at":"2026-08-18T00:47:39.478171Z","submitted_at":"2026-07-08T17:49:14Z","title":"Agon: Competitive Cross-Model RL with Implicit Rival Grading of Reasoning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-09T02:29:12.366018Z"},"links":{"cited_paper":"/paper/2502.00674","citing_paper":"/paper/2607.07690"},"observation_digest":"sha256:bd11b7fe966c374ce79109e383c17ea39c7e983fdaec3194ef7b5cef1e641874","observation_id":"f4478556-1642-4af0-ad24-9a002f7db2fc","resolution":{"observed_at":"2026-07-09T02:35:53.863433Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-20T02:39:51.179721Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":"2412.21187","doi":"10.48550/arxiv.2412.21187","metadata_source":"pith","pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","venue":"cs.CL","work_id":"d79f8b7d-560d-4fbd-bd70-4d084f6d9ad6","year":2024},"citing_paper":{"arxiv_id":"2607.07690","last_updated":"2026-07-08T17:49:14Z","snapshot_observed_at":"2026-08-18T00:47:39.478171Z","submitted_at":"2026-07-08T17:49:14Z","title":"Agon: Competitive Cross-Model RL with Implicit Rival Grading of Reasoning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-09T02:29:12.366018Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2607.07690"},"observation_digest":"sha256:109e09bb2b06759766034802ada48420df5b03a9e4df758956138bc77b77943a","observation_id":"8b4461bc-13ee-49a2-89a6-2bda15b70083","resolution":{"observed_at":"2026-07-09T02:35:53.856386Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.719296+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.719296+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-18T05:01:20.543826Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":"2503.14476","doi":"10.48550/arxiv.2503.14476","metadata_source":"pith","pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","venue":"cs.LG","work_id":"64019d00-0b11-4bbd-b173-b46c8fad0157","year":2025},"citing_paper":{"arxiv_id":"2607.07690","last_updated":"2026-07-08T17:49:14Z","snapshot_observed_at":"2026-08-18T00:47:39.478171Z","submitted_at":"2026-07-08T17:49:14Z","title":"Agon: Competitive Cross-Model RL with Implicit Rival Grading of Reasoning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-09T02:29:12.366018Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2607.07690"},"observation_digest":"sha256:00052d786aa0cb05985ec4221021387c2575de193a75e8bfe9cf572efe29db06","observation_id":"e4a74279-336c-4cc9-b890-8092b9490709","resolution":{"observed_at":"2026-07-09T02:35:53.858732Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:20.547492+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:20.547492+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03335","last_updated":"2025-10-16T08:23:36Z","snapshot_observed_at":"2026-08-11T20:12:00.210052Z","submitted_at":"2025-05-06T09:08:00Z","title":"Absolute Zero: Reinforced Self-play Reasoning with Zero Data","version":3},"cited_work":{"arxiv_id":"2505.03335","doi":"10.48550/arxiv.2505.03335","metadata_source":"pith","pith_arxiv_id":"2505.03335","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Absolute Zero: Reinforced Self-play Reasoning with Zero Data","venue":"cs.LG","work_id":"b59092c4-76ed-4c78-9006-312bde2e40a6","year":2025},"citing_paper":{"arxiv_id":"2607.07690","last_updated":"2026-07-08T17:49:14Z","snapshot_observed_at":"2026-08-18T00:47:39.478171Z","submitted_at":"2026-07-08T17:49:14Z","title":"Agon: Competitive Cross-Model RL with Implicit Rival Grading of Reasoning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-09T02:29:12.366018Z"},"links":{"cited_paper":"/paper/2505.03335","citing_paper":"/paper/2607.07690"},"observation_digest":"sha256:af7ba7b9b8846cf83c5c5b58084b5c7bf744d529eb18ef117c2f6b91365063fc","observation_id":"8c4eb0d9-fd91-4852-929b-5193a0ddc3e7","resolution":{"observed_at":"2026-07-09T02:35:53.872758Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-23T21:52:59.097203+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T21:52:59.097203+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.05004","last_updated":"2026-02-13T18:53:32Z","snapshot_observed_at":"2026-07-06T22:09:08.864232Z","submitted_at":"2025-08-07T03:38:16Z","title":"R-Zero: Self-Evolving Reasoning LLM from Zero Data","version":4},"cited_work":{"arxiv_id":"2508.05004","doi":"10.48550/arxiv.2508.05004","metadata_source":"pith","pith_arxiv_id":"2508.05004","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"R-Zero: Self-Evolving Reasoning LLM from Zero Data","venue":"cs.LG","work_id":"45b39aae-1151-4087-9b48-dd16313e6306","year":2025},"citing_paper":{"arxiv_id":"2607.07690","last_updated":"2026-07-08T17:49:14Z","snapshot_observed_at":"2026-08-18T00:47:39.478171Z","submitted_at":"2026-07-08T17:49:14Z","title":"Agon: Competitive Cross-Model RL with Implicit Rival Grading of Reasoning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-09T02:29:12.366018Z"},"links":{"cited_paper":"/paper/2508.05004","citing_paper":"/paper/2607.07690"},"observation_digest":"sha256:b795cd8f4c6485dec95573e95e5751d0d98418e8d9a30e1b9364cba97490b387","observation_id":"3dc2e27f-1376-472d-9505-122daa81c3d4","resolution":{"observed_at":"2026-07-09T02:35:53.849536Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-23T21:53:06.742139+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T21:53:06.742139+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14325","last_updated":"2023-05-23T17:55:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-23T17:55:11Z","title":"Improving Factuality and Reasoning in Language Models through Multiagent Debate","version":1},"cited_work":{"arxiv_id":"2305.14325","doi":"10.48550/arxiv.2305.14325","metadata_source":"pith","pith_arxiv_id":"2305.14325","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Improving Factuality and Reasoning in Language Models through Multiagent Debate","venue":"cs.CL","work_id":"a543e65c-1cf8-4182-b03b-33c0cd2c65d5","year":2023},"citing_paper":{"arxiv_id":"2607.07690","last_updated":"2026-07-08T17:49:14Z","snapshot_observed_at":"2026-08-18T00:47:39.478171Z","submitted_at":"2026-07-08T17:49:14Z","title":"Agon: Competitive Cross-Model RL with Implicit Rival Grading of Reasoning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-09T02:29:12.366018Z"},"links":{"cited_paper":"/paper/2305.14325","citing_paper":"/paper/2607.07690"},"observation_digest":"sha256:8a4d5fcdc60b0966ff74fdc3a798615e0d783eaf394c1e2222da8ef68bb95710","observation_id":"35730966-7e03-482c-b0b2-b0431a46b127","resolution":{"observed_at":"2026-07-09T02:35:53.854070Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.00899","last_updated":"2018-10-22T17:36:07Z","snapshot_observed_at":"2026-08-14T21:47:20.607853Z","submitted_at":"2018-05-02T16:27:32Z","title":"AI safety via debate","version":2},"cited_work":{"arxiv_id":"1805.00899","doi":"10.48550/arxiv.1805.00899","metadata_source":"pith","pith_arxiv_id":"1805.00899","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AI safety via debate","venue":"stat.ML","work_id":"13c1ec37-af93-438a-bdf0-f2eafaee5635","year":2018},"citing_paper":{"arxiv_id":"2607.07690","last_updated":"2026-07-08T17:49:14Z","snapshot_observed_at":"2026-08-18T00:47:39.478171Z","submitted_at":"2026-07-08T17:49:14Z","title":"Agon: Competitive Cross-Model RL with Implicit Rival Grading of Reasoning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-09T02:29:12.366018Z"},"links":{"cited_paper":"/paper/1805.00899","citing_paper":"/paper/2607.07690"},"observation_digest":"sha256:9d5f0687ca431c0f4cc15b0519111014772eee01c302a98f4094c3a2fb20b032","observation_id":"247014f7-214e-47ce-bcf1-df8bbdd196f4","resolution":{"observed_at":"2026-07-09T02:35:53.861079Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13692","last_updated":"2024-08-01T17:18:54Z","snapshot_observed_at":"2026-08-18T23:52:17.487601Z","submitted_at":"2024-07-18T16:58:18Z","title":"Prover-Verifier Games improve legibility of LLM outputs","version":2},"cited_work":{"arxiv_id":"2407.13692","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.13692","snapshot_observed_at":"2026-07-09T02:35:53.846004Z","title":"Prover-verifier games improve legibility of llm outputs","venue":"cs.CL","work_id":"2bebdadc-2df7-4816-93c8-70252a1645eb","year":2024},"citing_paper":{"arxiv_id":"2607.07690","last_updated":"2026-07-08T17:49:14Z","snapshot_observed_at":"2026-08-18T00:47:39.478171Z","submitted_at":"2026-07-08T17:49:14Z","title":"Agon: Competitive Cross-Model RL with Implicit Rival Grading of Reasoning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-09T02:29:12.366018Z"},"links":{"cited_paper":"/paper/2407.13692","citing_paper":"/paper/2607.07690"},"observation_digest":"sha256:62defa8c09d4afd60866ae9b1a3f064ccbdf18a3ad13b9d52de53a68b598d697","observation_id":"4b1b1f36-2229-4363-8bad-ee62b3ab3fd7","resolution":{"observed_at":"2026-07-09T02:35:53.847137Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T02:35:54.385493Z","title":"The 2026 AI Index Report, Chapter 2: Technical Performance","venue":null,"work_id":"a86f00f9-7d87-4777-a152-ce7d5036dc70","year":2026},"citing_paper":{"arxiv_id":"2607.07690","last_updated":"2026-07-08T17:49:14Z","snapshot_observed_at":"2026-08-18T00:47:39.478171Z","submitted_at":"2026-07-08T17:49:14Z","title":"Agon: Competitive Cross-Model RL with Implicit Rival Grading of Reasoning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-09T02:29:12.366018Z"},"links":{"citing_paper":"/paper/2607.07690"},"observation_digest":"sha256:b513eedbb67c64f1f093e5d9fda8f32d0914cb6f38d3de4280ee2ec8f6245678","observation_id":"43195baa-e0c0-4892-a195-0b1b34dce7b1","resolution":{"observed_at":"2026-07-09T02:35:54.386630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2607.07690","last_updated":"2026-07-08T17:49:14Z","snapshot_observed_at":"2026-08-18T00:47:39.478171Z","submitted_at":"2026-07-08T17:49:14Z","title":"Agon: Competitive Cross-Model RL with Implicit Rival Grading of Reasoning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-09T02:29:12.366018Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2607.07690"},"observation_digest":"sha256:f1067eeaa8b52c9a448d90e5c4e3316942182f097a59acd52ff9cb106027f933","observation_id":"059be145-2ae5-4663-88c4-898bbe5c21a2","resolution":{"observed_at":"2026-07-09T02:35:53.851785Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.07690","last_updated":"2026-07-08T17:49:14Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-18T00:47:39.478171Z","submitted_at":"2026-07-08T17:49:14Z","title":"Agon: Competitive Cross-Model RL with Implicit Rival Grading of Reasoning"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":13,"verified_fuzzy":1},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 0 inbound Pith citation observations for arXiv:2607.07690."}