{"as_of":"2026-08-05T20:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:14eac826de21f5476e672aabbd14ffa4569d4f95c214e4ef6b9c0ec61ef31c43","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-11T01:09:27.543625Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.07114/citation-record","integrity":"/paper/2605.07114/integrity","json":"/paper/2605.07114/citation-record.json","paper":"/paper/2605.07114"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Step guided reasoning: Improving mathematical reasoning using guidance generation and step reasoning","venue":null,"work_id":"26eeba88-8e50-4bb5-833b-93b62d871e6c","year":2025},"citing_paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-11T01:09:27.543625Z"},"links":{"citing_paper":"/paper/2605.07114"},"observation_digest":"sha256:5f39d043cd5c594479f9f080461e32280ff62854602d482504f4d0e46e92c04b","observation_id":"f1be6d6c-2aaf-413f-a5da-4baa2a475be2","resolution":{"observed_at":"2026-05-16T00:06:55.750928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":"2107.03374","doi":"10.48550/arxiv.2107.03374","metadata_source":"pith","pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating Large Language Models Trained on Code","venue":"cs.LG","work_id":"042493e9-b26f-4b4e-bbde-382072ca9b08","year":2021},"citing_paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-11T01:09:27.543625Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2605.07114"},"observation_digest":"sha256:29d806377be3bf92814104a929e4b47d3a61eaaf218482adb61fad7e5dabee43","observation_id":"41fad8c2-676d-4432-a421-b9e43f16a3cb","resolution":{"observed_at":"2026-05-11T04:40:59.548091Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.19942","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T15:09:54.149979Z","title":"Differential smooth- ing mitigates sharpening and improves llm reasoning.arXiv preprint arXiv:2511.19942","venue":null,"work_id":"58416bfc-a305-46a9-a2c7-0c0e5f94db45","year":2025},"citing_paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-11T01:09:27.543625Z"},"links":{"citing_paper":"/paper/2605.07114"},"observation_digest":"sha256:ba31ee0d4ba0e454bee784fe0d66c745373b1174799d086dc2efd7f70dd04237","observation_id":"af22db31-4f35-4b14-a9e4-1b318f3c9147","resolution":{"observed_at":"2026-05-11T04:40:59.556925Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rewarding the unlikely: Lifting grpo beyond distribution sharpening","venue":null,"work_id":"a20c9b4d-a06a-474b-8e74-7834b9c48a5b","year":2025},"citing_paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-11T01:09:27.543625Z"},"links":{"citing_paper":"/paper/2605.07114"},"observation_digest":"sha256:00647e835baa9e722887f783c9545db7090ef7b75a05eee0277c153e0299fad2","observation_id":"83043b97-c0d9-48c3-ab21-c59f1780777c","resolution":{"observed_at":"2026-05-16T00:06:55.741460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":"2103.03874","doi":"10.48550/arxiv.2103.03874","metadata_source":"pith","pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","venue":"cs.LG","work_id":"50652ac6-fb7c-4675-a2c2-159c241feb17","year":2021},"citing_paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-11T01:09:27.543625Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2605.07114"},"observation_digest":"sha256:a811c603db064ad6a2f7d58c90e1921b63c9894fb8e8fc509ebf66f0dc411cf4","observation_id":"933a320e-f56f-4b02-b16d-e2c3b08f44bb","resolution":{"observed_at":"2026-05-11T04:40:59.539550Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:22.649941+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:22.649941+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20783","last_updated":"2025-10-06T09:30:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T17:59:14Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","version":2},"cited_work":{"arxiv_id":"2503.20783","doi":"10.48550/arxiv.2503.20783","metadata_source":"pith","pith_arxiv_id":"2503.20783","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","venue":"cs.LG","work_id":"ec354f3b-9484-4a0c-94c8-92d4d0260835","year":2025},"citing_paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-11T01:09:27.543625Z"},"links":{"cited_paper":"/paper/2503.20783","citing_paper":"/paper/2605.07114"},"observation_digest":"sha256:5e70cb6631a9325eb3c25c25984b502695595498adcf5374705beef4c39fd6e7","observation_id":"706c466b-8b7c-4da7-9c75-f47773ce47a5","resolution":{"observed_at":"2026-05-11T04:40:59.574754Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T09:23:05.84445+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T09:23:05.84445+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.01601","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T09:55:41.106035Z","title":"Adaptive rollout allocation for online reinforcement learning with verifiable rewards","venue":null,"work_id":"44fed812-85b4-414f-a774-b0d7d9fe7670","year":2026},"citing_paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-11T01:09:27.543625Z"},"links":{"citing_paper":"/paper/2605.07114"},"observation_digest":"sha256:772dfaa5ee83672e1b45a18c5df4963a681aa029728a7c7ef62b8d934e852ea1","observation_id":"d25db324-9220-4eec-85a0-b096ff28838f","resolution":{"observed_at":"2026-05-11T04:40:59.592552Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.18760","last_updated":"2026-05-29T09:54:53Z","snapshot_observed_at":"2026-08-03T20:43:39.363983Z","submitted_at":"2025-11-24T04:50:18Z","title":"HERMES: Towards Efficient and Verifiable Mathematical Reasoning in LLMs","version":2},"cited_work":{"arxiv_id":"2511.18760","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2511.18760","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hermes: Towards efficient and verifiable mathematical reasoning in llms.arXiv preprint arXiv:2511.18760","venue":null,"work_id":"aadf6737-dd8f-4930-8333-b5077c9ded19","year":null},"citing_paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-11T01:09:27.543625Z"},"links":{"cited_paper":"/paper/2511.18760","citing_paper":"/paper/2605.07114"},"observation_digest":"sha256:c65c3d80bc57ea883e062194bc70762a1f0cbd54ed01c7b10151188467132516","observation_id":"9742e471-1cd7-4ea7-8607-6d6c3920cad0","resolution":{"observed_at":"2026-06-01T02:03:29.943232Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2410.03131","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"https://arxiv.org/abs/2410.03131","venue":null,"work_id":"afbf6d71-1889-4e6f-94aa-72a99fafd1c8","year":2024},"citing_paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-11T01:09:27.543625Z"},"links":{"citing_paper":"/paper/2605.07114"},"observation_digest":"sha256:a6660edb328d599a453263935ea793c5b6e70721cd7eeb1537b89ebb333d098b","observation_id":"60aa04d6-5746-4ab5-88d9-46e5d1f1cab0","resolution":{"observed_at":"2026-05-11T04:40:59.568271Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.01970","last_updated":"2026-05-15T12:23:06Z","snapshot_observed_at":"2026-07-06T22:44:04.951815Z","submitted_at":"2026-02-02T11:24:36Z","title":"Small Generalizable Prompt Predictive Models Can Steer Efficient RL Post-Training of Large Reasoning Models","version":2},"cited_work":{"arxiv_id":"2602.01970","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.01970","snapshot_observed_at":"2026-07-03T04:27:36.735683Z","title":"Small Generalizable Prompt Predictive Models Can Steer Efficient RL Post-Training of Large Reasoning Models","venue":"cs.AI","work_id":"32928829-6186-4b4e-97b1-64456ba0cb19","year":2026},"citing_paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-11T01:09:27.543625Z"},"links":{"cited_paper":"/paper/2602.01970","citing_paper":"/paper/2605.07114"},"observation_digest":"sha256:108b90e17788120cc6c018bec50a3505e6fce921a0f83487a0d20ea0fb1db44d","observation_id":"b394ff8a-c1c7-4159-bef6-1ebce99cdd98","resolution":{"observed_at":"2026-05-20T00:00:33.173797Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-11T01:09:27.543625Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.07114"},"observation_digest":"sha256:ecbfdc16bbc1ce1ee6f09e68d257fbb906bbcb0e793d64045b68f89136532a59","observation_id":"336fd8d0-5125-42c1-b43a-7399cb6f9eb8","resolution":{"observed_at":"2026-05-11T04:40:59.524414Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01939","last_updated":"2025-11-13T10:08:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-02T17:54:39Z","title":"Beyond the 80/20 Rule: High-Entropy Minority Tokens Drive Effective Reinforcement Learning for LLM Reasoning","version":2},"cited_work":{"arxiv_id":"2506.01939","doi":"10.48550/arxiv.2506.01939","metadata_source":"pith","pith_arxiv_id":"2506.01939","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Beyond the 80/20 Rule: High-Entropy Minority Tokens Drive Effective Reinforcement Learning for LLM Reasoning","venue":"cs.CL","work_id":"e5e936f3-0cff-4732-b394-f607d7a63f5f","year":2025},"citing_paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-11T01:09:27.543625Z"},"links":{"cited_paper":"/paper/2506.01939","citing_paper":"/paper/2605.07114"},"observation_digest":"sha256:4faca461a5b48fdf3a96885005e323e3c20f906dfe1cb94dcc0482603a8a005d","observation_id":"68092739-f75c-4792-8f60-b7d3fd897957","resolution":{"observed_at":"2026-05-12T12:12:09.004283Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:08.024018+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:08.024018+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14245","last_updated":"2025-10-02T11:31:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-17T07:06:56Z","title":"Reinforcement Learning with Verifiable Rewards Implicitly Incentivizes Correct Reasoning in Base LLMs","version":2},"cited_work":{"arxiv_id":"2506.14245","doi":"10.48550/arxiv.2506.14245","metadata_source":"pith","pith_arxiv_id":"2506.14245","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reinforcement Learning with Verifiable Rewards Implicitly Incentivizes Correct Reasoning in Base LLMs","venue":"cs.AI","work_id":"fa639861-d1ef-4d97-80bd-79e11a62e73c","year":2025},"citing_paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-11T01:09:27.543625Z"},"links":{"cited_paper":"/paper/2506.14245","citing_paper":"/paper/2605.07114"},"observation_digest":"sha256:8dcc3dae64b2440f16cb035040e295dc8a11e8a13dbacd4fb7999a8e383ae440","observation_id":"3e8e6f52-3640-4926-bd8d-e9c90a41bfa5","resolution":{"observed_at":"2026-05-13T12:44:27.816864Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.14843","doi":"10.48550/arxiv.2507.14843","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The invisible leash: Why rlvr may or may not escape its origin","venue":"arXiv (Cornell University)","work_id":"71f17397-1cd4-4f68-ab1d-e91bb5f5953d","year":2025},"citing_paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-11T01:09:27.543625Z"},"links":{"citing_paper":"/paper/2605.07114"},"observation_digest":"sha256:a6e5da7805bf7e4ec3694bd1fe6dacca78db345b1d3472aa872db5926f86a901","observation_id":"f2752ca1-08e0-4c46-950b-80e8ee3d8af5","resolution":{"observed_at":"2026-05-11T04:40:59.426365Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.15115","doi":"10.1145/3581783.3612503","metadata_source":"pith","pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5 Technical Report","venue":"cs.CL","work_id":"d8432992-4980-4a81-85c7-9fa2c2b87f85","year":2024},"citing_paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-11T01:09:27.543625Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2605.07114"},"observation_digest":"sha256:a1f097b3727be233b0fad6fc12621376a856543011e14e67d25b73bbc1df9e83","observation_id":"53a922e5-6fa6-435c-8a4e-6deed89a33f8","resolution":{"observed_at":"2026-05-11T04:40:59.515986Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":"2503.14476","doi":"10.48550/arxiv.2503.14476","metadata_source":"pith","pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","venue":"cs.LG","work_id":"64019d00-0b11-4bbd-b173-b46c8fad0157","year":2025},"citing_paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-11T01:09:27.543625Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2605.07114"},"observation_digest":"sha256:4652f672bd50aba2dfa101a825def7245cbda8e1f7a10ad6018efa9c6ea1b3d3","observation_id":"eea7058f-6ac4-4a5c-be4a-ec370f40a36a","resolution":{"observed_at":"2026-05-11T04:40:59.532268Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13837","last_updated":"2025-11-24T06:11:04Z","snapshot_observed_at":"2026-07-06T21:11:34.701779Z","submitted_at":"2025-04-18T17:59:56Z","title":"Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?","version":5},"cited_work":{"arxiv_id":"2504.13837","doi":"10.48550/arxiv.2504.13837","metadata_source":"pith","pith_arxiv_id":"2504.13837","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?","venue":"cs.AI","work_id":"d854765a-e664-41c0-8655-21c4bf2e0cc4","year":2025},"citing_paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-11T01:09:27.543625Z"},"links":{"cited_paper":"/paper/2504.13837","citing_paper":"/paper/2605.07114"},"observation_digest":"sha256:0d6a8ca35996cfb9ee6dd540760237eddd9053415e693023948878818b9b16c4","observation_id":"cb832be7-f953-45a4-b813-6f382984b891","resolution":{"observed_at":"2026-05-11T04:40:59.500399Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:42.002839+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:42.002839+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18892","last_updated":"2025-08-06T08:42:32Z","snapshot_observed_at":"2026-07-06T20:57:57.039376Z","submitted_at":"2025-03-24T17:06:10Z","title":"SimpleRL-Zoo: Investigating and Taming Zero Reinforcement Learning for Open Base Models in the Wild","version":3},"cited_work":{"arxiv_id":"2503.18892","doi":"10.48550/arxiv.2503.18892","metadata_source":"pith","pith_arxiv_id":"2503.18892","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SimpleRL-Zoo: Investigating and Taming Zero Reinforcement Learning for Open Base Models in the Wild","venue":"cs.LG","work_id":"94a68437-02e7-425a-91b2-5846ddcbd38c","year":2025},"citing_paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-11T01:09:27.543625Z"},"links":{"cited_paper":"/paper/2503.18892","citing_paper":"/paper/2605.07114"},"observation_digest":"sha256:ee065bd566626f77f2da7056a85b4ffc410bee7fd26573db6d27294c06b86e06","observation_id":"cf135d09-7837-4246-b4b7-4bd9ba93b27a","resolution":{"observed_at":"2026-05-13T08:21:05.971096Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.10959","last_updated":"2026-04-17T05:25:22Z","snapshot_observed_at":"2026-07-06T22:32:27.698678Z","submitted_at":"2025-10-13T03:10:26Z","title":"Revisiting Entropy Regularization: Adaptive Coefficient Unlocks Its Potential for LLM Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2510.10959","doi":"10.48550/arxiv.2510.10959","metadata_source":"pith","pith_arxiv_id":"2510.10959","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Revisiting Entropy Regularization: Adaptive Coefficient Unlocks Its Potential for LLM Reinforcement Learning","venue":"cs.LG","work_id":"37a48931-2e72-4b4c-babf-113dafd427cf","year":2025},"citing_paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-11T01:09:27.543625Z"},"links":{"cited_paper":"/paper/2510.10959","citing_paper":"/paper/2605.07114"},"observation_digest":"sha256:74af99c8caa5e4ed1ec52cbddd6a6d4048c41b58dda09fd6887c8e952fe2d650","observation_id":"b9d6e023-75e0-4971-8103-52dfbd9ceff7","resolution":{"observed_at":"2026-05-11T04:40:59.493685Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.01347","doi":"10.48550/arxiv.2506.01347","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The surprising effectiveness of negative reinforcement in llm reasoning.arXiv preprint arXiv:2506.01347","venue":"ArXiv.org","work_id":"90fa4c77-dcfb-4253-827e-9bde0d342fcb","year":2025},"citing_paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-11T01:09:27.543625Z"},"links":{"citing_paper":"/paper/2605.07114"},"observation_digest":"sha256:102cd8a0fcb95c7acb5d7a76e64f13031bcfa7e88c12b433a3ad6ea4fafa0e94","observation_id":"d49cfb48-64b8-4180-9a8e-4e09621d3627","resolution":{"observed_at":"2026-05-11T04:40:59.442026Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"All runs use the TRL implementation of GRPO with vLLM rollout in colocate mode","venue":null,"work_id":"3f4bce45-7462-4c73-a27a-40465571d395","year":2048},"citing_paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-11T01:09:27.543625Z"},"links":{"citing_paper":"/paper/2605.07114"},"observation_digest":"sha256:5eb313347a69ea0f6b5629da036753a43722ed0be8f5686ef2272671f1931b9d","observation_id":"372bcb32-3471-4e8e-8a13-27986db56ee2","resolution":{"observed_at":"2026-05-16T00:06:55.733072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"adc2b96e-d23e-402d-a43d-4854507066e0","year":2048},"citing_paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-11T01:09:27.543625Z"},"links":{"citing_paper":"/paper/2605.07114"},"observation_digest":"sha256:4a9bc288145883dd08d5a0bdeb2d2054f7b1902f22db448a42604506ac51ee2b","observation_id":"6c2bf8eb-68a4-4030-8ded-903593f7f9dd","resolution":{"observed_at":"2026-05-16T00:06:55.754100Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5d70b84a-1e08-4d22-bf6d-9fae485274f4","year":2024},"citing_paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-11T01:09:27.543625Z"},"links":{"citing_paper":"/paper/2605.07114"},"observation_digest":"sha256:c2b3796bc4dcfd772e01e17b3c9bb498e173a36c3445264f2cecea541f160d68","observation_id":"184449ce-eb5a-4cff-826a-0c58d63715e4","resolution":{"observed_at":"2026-05-16T00:06:55.747722Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"037f7dfd-060a-4f40-b965-d9a160aba436","year":2024},"citing_paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-11T01:09:27.543625Z"},"links":{"citing_paper":"/paper/2605.07114"},"observation_digest":"sha256:0b35e6941cb5a275165c5e9560a7abeb530e31bd0836e8ccfdc21d5b91e41c58","observation_id":"5aad2fe9-7091-4b50-9c86-2303e012a8d6","resolution":{"observed_at":"2026-05-16T00:06:55.744782Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The fixedBeta(1, 1)prior used by HORA (solid blue) is compared against the five learned-prior variants described above","venue":null,"work_id":"e04fa9ff-5247-4350-aa56-c3c1aef682dd","year":2025},"citing_paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-11T01:09:27.543625Z"},"links":{"citing_paper":"/paper/2605.07114"},"observation_digest":"sha256:f55bc870b003c96487e036335b567c0e937c03bc843e455fcc768479957bca2a","observation_id":"c0cb0aea-e525-4d72-b7c3-a37e5017adba","resolution":{"observed_at":"2026-05-16T00:06:55.738172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.07114","last_updated":"2026-05-08T01:42:25Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T23:19:30.387067Z","submitted_at":"2026-05-08T01:42:25Z","title":"Where to Spend Rollouts: Hit-Utility Optimal Rollout Allocation for Group-Based RLVR"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":3,"verified_exact":17,"verified_fuzzy":4},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2605.07114."}