{"as_of":"2026-08-07T13:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:19de873c3ed759ed5f6155c963f39660e269db3d8c4b4f53c07b4f865d19a3fc","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-21T05:19:11.738106Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.21468/citation-record","integrity":"/paper/2605.21468/integrity","json":"/paper/2605.21468/citation-record.json","paper":"/paper/2605.21468"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.11446","last_updated":"2026-04-13T13:28:12Z","snapshot_observed_at":"2026-07-06T22:59:49.614780Z","submitted_at":"2026-04-13T13:28:12Z","title":"Low-rank Optimization Trajectories Modeling for LLM RLVR Acceleration","version":1},"cited_work":{"arxiv_id":"2604.11446","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.11446","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Low-rank Optimization Trajectories Modeling for LLM RLVR Acceleration","venue":"cs.LG","work_id":"d721e4dc-b6d5-4696-9ba3-1d79508002f6","year":2026},"citing_paper":{"arxiv_id":"2605.21468","last_updated":"2026-05-20T17:53:20Z","snapshot_observed_at":"2026-07-06T23:31:56.199912Z","submitted_at":"2026-05-20T17:53:20Z","title":"You Only Need Minimal RLVR Training: Extrapolating LLMs via Rank-1 Trajectories","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-21T05:19:11.738106Z"},"links":{"cited_paper":"/paper/2604.11446","citing_paper":"/paper/2605.21468"},"observation_digest":"sha256:93f119c18c0466cb8b33db3ef8e76e174161d14436e5f6d6d566c905fc62241b","observation_id":"045dee46-67ac-4fc4-92e9-20585a9b324b","resolution":{"observed_at":"2026-05-21T05:19:39.174452Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.00674","last_updated":"2026-05-15T17:10:37Z","snapshot_observed_at":"2026-07-06T23:14:01.852096Z","submitted_at":"2026-05-01T13:56:34Z","title":"Beyond Benchmarks: MathArena as an Evaluation Platform for Mathematics with LLMs","version":2},"cited_work":{"arxiv_id":"2605.00674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.00674","snapshot_observed_at":"2026-07-10T09:37:00.861422Z","title":"Beyond Benchmarks: MathArena as an Evaluation Platform for Mathematics with LLMs","venue":"cs.CL","work_id":"a302077a-ac03-4988-adce-c84a57db5425","year":2026},"citing_paper":{"arxiv_id":"2605.21468","last_updated":"2026-05-20T17:53:20Z","snapshot_observed_at":"2026-07-06T23:31:56.199912Z","submitted_at":"2026-05-20T17:53:20Z","title":"You Only Need Minimal RLVR Training: Extrapolating LLMs via Rank-1 Trajectories","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-21T05:19:11.738106Z"},"links":{"cited_paper":"/paper/2605.00674","citing_paper":"/paper/2605.21468"},"observation_digest":"sha256:116cbd2f9bb773189060f806c3d7a4be89197b51727985e76819e45c0beb00c4","observation_id":"5df37922-13a6-4002-bb1d-74195db52626","resolution":{"observed_at":"2026-05-21T05:19:39.166197Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2605.21468","last_updated":"2026-05-20T17:53:20Z","snapshot_observed_at":"2026-07-06T23:31:56.199912Z","submitted_at":"2026-05-20T17:53:20Z","title":"You Only Need Minimal RLVR Training: Extrapolating LLMs via Rank-1 Trajectories","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-21T05:19:11.738106Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2605.21468"},"observation_digest":"sha256:e4f23fa496bb46df61775d5f96d5de759a6d56bb9c1c4b014219526f2eb62f6d","observation_id":"7dedee24-7b67-40a0-a187-35432e041e24","resolution":{"observed_at":"2026-05-21T05:19:39.189119Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.14872","last_updated":"2026-06-29T01:04:09Z","snapshot_observed_at":"2026-08-02T23:11:47.613570Z","submitted_at":"2026-02-16T16:03:08Z","title":"On the Emergence of Implicit Curriculum in RLVR Learning Dynamics","version":3},"cited_work":{"arxiv_id":"2602.14872","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.14872","snapshot_observed_at":"2026-07-02T02:56:29.139436Z","title":"The Implicit Curriculum: Learning Dynamics in RL with Verifiable Rewards","venue":"cs.LG","work_id":"b078b267-c10d-4a36-88a5-7bee845fc37b","year":2026},"citing_paper":{"arxiv_id":"2605.21468","last_updated":"2026-05-20T17:53:20Z","snapshot_observed_at":"2026-07-06T23:31:56.199912Z","submitted_at":"2026-05-20T17:53:20Z","title":"You Only Need Minimal RLVR Training: Extrapolating LLMs via Rank-1 Trajectories","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-21T05:19:11.738106Z"},"links":{"cited_paper":"/paper/2602.14872","citing_paper":"/paper/2605.21468"},"observation_digest":"sha256:2fa55419fc720f3553e7b2db3b687efdaafd3c660a32e4bd51049a686dcb52e2","observation_id":"54a19620-adf0-4f3a-a51b-a3ce7e9f0f15","resolution":{"observed_at":"2026-05-21T05:19:39.157678Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":"2001.08361","doi":"10.1145/3616855.3635845","metadata_source":"pith","pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Laws for Neural Language Models","venue":"cs.LG","work_id":"b7dd8749-9c45-4977-ab9b-64478dce1ae8","year":2020},"citing_paper":{"arxiv_id":"2605.21468","last_updated":"2026-05-20T17:53:20Z","snapshot_observed_at":"2026-07-06T23:31:56.199912Z","submitted_at":"2026-05-20T17:53:20Z","title":"You Only Need Minimal RLVR Training: Extrapolating LLMs via Rank-1 Trajectories","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-21T05:19:11.738106Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2605.21468"},"observation_digest":"sha256:fdc32e739b1485b2d99db6fdf02417b35a9607cbda272af77b570899a7b19e94","observation_id":"83764595-42ad-45c5-8e80-3190892d8a55","resolution":{"observed_at":"2026-05-21T05:19:39.163459Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.21468","last_updated":"2026-05-20T17:53:20Z","snapshot_observed_at":"2026-07-06T23:31:56.199912Z","submitted_at":"2026-05-20T17:53:20Z","title":"You Only Need Minimal RLVR Training: Extrapolating LLMs via Rank-1 Trajectories","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-21T05:19:11.738106Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.21468"},"observation_digest":"sha256:ba7879535e282d0b45d479552098d298fa517bba3f324614dd3eabd5e99e9801","observation_id":"102f4e88-2b6f-4b7c-be28-6fa098c5dfc3","resolution":{"observed_at":"2026-05-21T05:19:39.171370Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.21468","last_updated":"2026-05-20T17:53:20Z","snapshot_observed_at":"2026-07-06T23:31:56.199912Z","submitted_at":"2026-05-20T17:53:20Z","title":"You Only Need Minimal RLVR Training: Extrapolating LLMs via Rank-1 Trajectories","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T05:19:11.738106Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.21468"},"observation_digest":"sha256:af92b88235e0abf7a8262ca4fa13db6da81a6715da840cfe03d0632f3e577a58","observation_id":"55a123c7-fb5f-4313-9655-089cf116aeca","resolution":{"observed_at":"2026-05-21T05:19:39.168876Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.04537","last_updated":"2026-05-21T08:36:53Z","snapshot_observed_at":"2026-08-02T10:27:57.223889Z","submitted_at":"2026-01-08T03:06:18Z","title":"Linear Dynamics in the RLVR Training of Large Language Models","version":3},"cited_work":{"arxiv_id":"2601.04537","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.04537","snapshot_observed_at":"2026-06-29T14:43:30.547132Z","title":"Not all steps are informative: On the linearity of LLMs’ RLVR training.arXiv preprint arXiv:2601.04537","venue":"cs.LG","work_id":"6ed388c6-5945-4427-b060-f8afc7736d51","year":2026},"citing_paper":{"arxiv_id":"2605.21468","last_updated":"2026-05-20T17:53:20Z","snapshot_observed_at":"2026-07-06T23:31:56.199912Z","submitted_at":"2026-05-20T17:53:20Z","title":"You Only Need Minimal RLVR Training: Extrapolating LLMs via Rank-1 Trajectories","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-21T05:19:11.738106Z"},"links":{"cited_paper":"/paper/2601.04537","citing_paper":"/paper/2605.21468"},"observation_digest":"sha256:67402a9279d1befac93276d2a6ed27c7c14e422f7254942612b93bf4231b0538","observation_id":"d57c11c3-5dc4-4f5c-ad18-85729c301de2","resolution":{"observed_at":"2026-05-22T02:03:53.599274Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":"2409.12122","doi":"10.18653/v1/2025.emnlp-main.712","metadata_source":"pith","pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","venue":"cs.CL","work_id":"a097c5d4-6d32-46ee-9826-57d532bbfc9c","year":2024},"citing_paper":{"arxiv_id":"2605.21468","last_updated":"2026-05-20T17:53:20Z","snapshot_observed_at":"2026-07-06T23:31:56.199912Z","submitted_at":"2026-05-20T17:53:20Z","title":"You Only Need Minimal RLVR Training: Extrapolating LLMs via Rank-1 Trajectories","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-21T05:19:11.738106Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2605.21468"},"observation_digest":"sha256:d5aeb11f8bb6dcec0bd65ef691ef736701a6a280ef5c848a466886cc083001b4","observation_id":"b6c925f6-e75f-4990-aa3b-339165ac8fe2","resolution":{"observed_at":"2026-05-21T05:19:39.191872Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.21468","last_updated":"2026-05-20T17:53:20Z","snapshot_observed_at":"2026-07-06T23:31:56.199912Z","submitted_at":"2026-05-20T17:53:20Z","title":"You Only Need Minimal RLVR Training: Extrapolating LLMs via Rank-1 Trajectories","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-21T05:19:11.738106Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.21468"},"observation_digest":"sha256:7afa1d96e6262c339b2a5ac7e3816ed5718ba82d26cd3d382f1ddde39343ab8e","observation_id":"a4e27f99-c2b6-4a74-8344-1a82f5bb7122","resolution":{"observed_at":"2026-05-21T05:19:39.160804Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.06523","last_updated":"2026-05-07T16:30:28Z","snapshot_observed_at":"2026-07-06T23:19:00.794334Z","submitted_at":"2026-05-07T16:30:28Z","title":"On the Implicit Reward Overfitting and the Low-rank Dynamics in RLVR","version":1},"cited_work":{"arxiv_id":"2605.06523","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.06523","snapshot_observed_at":"2026-07-03T21:08:57.707903Z","title":"On the Implicit Reward Overfitting and the Low-rank Dynamics in RLVR","venue":"cs.LG","work_id":"2243a140-e9cf-4496-bcb7-cedb0b8160f5","year":2026},"citing_paper":{"arxiv_id":"2605.21468","last_updated":"2026-05-20T17:53:20Z","snapshot_observed_at":"2026-07-06T23:31:56.199912Z","submitted_at":"2026-05-20T17:53:20Z","title":"You Only Need Minimal RLVR Training: Extrapolating LLMs via Rank-1 Trajectories","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-21T05:19:11.738106Z"},"links":{"cited_paper":"/paper/2605.06523","citing_paper":"/paper/2605.21468"},"observation_digest":"sha256:900388a374c7a449946b80f310e1577cc8bdeaa64855740ba0c50c8b06b83d63","observation_id":"00206f39-4726-464a-aabe-8eef1fc32c5f","resolution":{"observed_at":"2026-05-21T05:19:39.180936Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.07998","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T10:39:45.043718Z","title":"arXiv preprint arXiv:2506.07998 , year=","venue":null,"work_id":"6923ca23-e83b-48e1-bd74-2265ef694d6f","year":2025},"citing_paper":{"arxiv_id":"2605.21468","last_updated":"2026-05-20T17:53:20Z","snapshot_observed_at":"2026-07-06T23:31:56.199912Z","submitted_at":"2026-05-20T17:53:20Z","title":"You Only Need Minimal RLVR Training: Extrapolating LLMs via Rank-1 Trajectories","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-21T05:19:11.738106Z"},"links":{"citing_paper":"/paper/2605.21468"},"observation_digest":"sha256:aeaac50938e5cc427b63ad58e972d27aa9db80f338f5de5aa42a77427cb70807","observation_id":"f4db0f03-3c1b-4abc-9cac-110cfbffa626","resolution":{"observed_at":"2026-05-21T05:19:39.183691Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.08567","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T00:29:15.401355Z","title":"Pan, Zhangyang Wang, Yuandong Tian, and Kai Sheng Tai","venue":null,"work_id":"01d49b76-36f4-4f7d-8d64-759d92c796da","year":2025},"citing_paper":{"arxiv_id":"2605.21468","last_updated":"2026-05-20T17:53:20Z","snapshot_observed_at":"2026-07-06T23:31:56.199912Z","submitted_at":"2026-05-20T17:53:20Z","title":"You Only Need Minimal RLVR Training: Extrapolating LLMs via Rank-1 Trajectories","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-21T05:19:11.738106Z"},"links":{"citing_paper":"/paper/2605.21468"},"observation_digest":"sha256:4f605e3f53d7fa899d46b2b1aed6c2075a7d5e12a0e48274587d5bd39b37a4c6","observation_id":"70d1e977-8f55-4950-aa5b-09ed2d940e21","resolution":{"observed_at":"2026-05-21T05:19:39.186539Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"502619cd-c987-404e-8175-8fc2a94be46d","year":2026},"citing_paper":{"arxiv_id":"2605.21468","last_updated":"2026-05-20T17:53:20Z","snapshot_observed_at":"2026-07-06T23:31:56.199912Z","submitted_at":"2026-05-20T17:53:20Z","title":"You Only Need Minimal RLVR Training: Extrapolating LLMs via Rank-1 Trajectories","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-21T05:19:11.738106Z"},"links":{"citing_paper":"/paper/2605.21468"},"observation_digest":"sha256:67820c08542e858e79978b9d72dc19ccae71655e9a9fdf52a2a27529bffb76bd","observation_id":"9c986d15-323e-4577-a3c1-134a955de13c","resolution":{"observed_at":"2026-05-21T05:19:39.605503Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.21468","last_updated":"2026-05-20T17:53:20Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T23:31:56.199912Z","submitted_at":"2026-05-20T17:53:20Z","title":"You Only Need Minimal RLVR Training: Extrapolating LLMs via Rank-1 Trajectories"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":1,"verified_exact":11,"verified_fuzzy":0},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 0 inbound Pith citation observations for arXiv:2605.21468."}