{"as_of":"2026-08-07T23:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:64d7cfb3b831964df464a0ecc271cb4dc7db3cef09f48a49a958bcddc7059929","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:01:24.023367Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-22T07:40:35.113858Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"cited_work":{"arxiv_id":"2506.22950","doi":"10.48550/arxiv.2506.22950","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.22950","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URL https: //doi.org/10.48550/arXiv.2506.22950","venue":"ArXiv.org","work_id":"97ff21b5-2812-4cf3-a5d4-b9513b859a15","year":null},"citing_paper":{"arxiv_id":"2605.22537","last_updated":"2026-05-21T14:25:24Z","snapshot_observed_at":"2026-07-06T23:32:49.530788Z","submitted_at":"2026-05-21T14:25:24Z","title":"F-TIS: Harnessing Diverse Models in Collaborative GRPO","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-22T07:40:35.113858Z"},"links":{"cited_paper":"/paper/2506.22950","citing_paper":"/paper/2605.22537"},"observation_digest":"sha256:f77c55ebdd81f1a48b30b217818c099466877a78f17fa02f1f3cae431e64f0ba","observation_id":"9cd97a3e-0019-4e55-a89f-21905f666d43","resolution":{"observed_at":"2026-05-22T07:41:14.382554Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.22950/citation-record","integrity":"/paper/2506.22950/integrity","json":"/paper/2506.22950/citation-record.json","paper":"/paper/2506.22950"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-06T22:01:23.593717Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.593717Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:11bc2afd1dbeca82849e427773ab0adacb2639cc2b02b522cc2e627e6b59aa51","observation_id":"ae54f573-f745-4daf-ba65-108b384d61d9","resolution":{"observed_at":"2026-08-06T22:01:23.593717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:01:25.025118Z","title":null,"venue":null,"work_id":"712a8224-b037-49b3-a705-4149aa83e726","year":null},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.600719Z"},"links":{"citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:e55f5291829718b82ebf2b7957be2aca24dfe88b6cba7d9f5aca0f8c2da92355","observation_id":"a0ffcfce-48fd-4696-8714-fe408679f181","resolution":{"observed_at":"2026-08-06T22:01:25.031292Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-06T22:01:23.612403Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.612403Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:1a900fa7644a0ba5ed867c28978ccf53ca91bc07f2016e71a3c40def5176a3a1","observation_id":"35687e8f-703a-4f9d-a023-0057372a4b2d","resolution":{"observed_at":"2026-08-06T22:01:23.612403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-06T22:01:23.617039Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.617039Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:372f326007599cd2ba4fc195c67278ddffa826e7a48bf57ae7b9a9e5c1bb88b0","observation_id":"1fd0fafb-220a-499d-8d60-0cd0fefc6f90","resolution":{"observed_at":"2026-08-06T22:01:23.617039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.14135","last_updated":"2022-06-23T17:53:32Z","snapshot_observed_at":"2026-07-06T13:14:48.753329Z","submitted_at":"2022-05-27T17:53:09Z","title":"FlashAttention: Fast and Memory-Efficient Exact Attention with IO-Awareness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.14135","snapshot_observed_at":"2026-08-06T22:01:23.623374Z","title":"Fu, Stefano Ermon, Atri Rudra, and Christopher Ré","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.623374Z"},"links":{"cited_paper":"/paper/2205.14135","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:b7412725d4f347ef3b616870b3656deeb0c81fa07ffb3dcb4d3fa07aeb0bf264","observation_id":"9ce02750-4d96-4171-96db-47d2b1064493","resolution":{"observed_at":"2026-08-06T22:01:23.623374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-06T22:01:23.629095Z","title":"Zhang, Han Bao, Hanwei Xu, Haocheng Wang, Haowei Zhang, Honghui Ding, Huajian Xin, Huazuo Gao, Hui Li, Hui Qu, J","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.629095Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:51394577e124eea13d7d7e9a33b972e97516ac94856b5bca4fbc3cfb68226b97","observation_id":"02ca16c4-bb02-4f1a-9a5d-807e42616aab","resolution":{"observed_at":"2026-08-06T22:01:23.629095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-06T22:01:23.637326Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.637326Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:f221bacaa4f290a0d73de1030ea2ff0486232ccdbd4664b5bc4f2082eedd3431","observation_id":"7873e5f0-ff6d-4453-90e0-d934f9058916","resolution":{"observed_at":"2026-08-06T22:01:23.637326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:01:24.996291Z","title":null,"venue":null,"work_id":"f9580e66-18e3-4909-b7db-981ddb8c5213","year":null},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.643295Z"},"links":{"citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:e06b11a1f880ddc41b53036b2ed342fef4ba173620ceea5c466467f49db8c269","observation_id":"7ab8bd83-868e-4506-8a6c-85bd7c9ace69","resolution":{"observed_at":"2026-08-06T22:01:25.004161Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T22:01:23.653086Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.653086Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:115ddc96cfda96ca5bdc7de24833ddd1e15a1bf5cc0d2f1ade3d867836ff14e1","observation_id":"21cdab9b-a7df-42a8-b479-38dd412f7c39","resolution":{"observed_at":"2026-08-06T22:01:23.653086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24298","last_updated":"2026-03-02T03:07:29Z","snapshot_observed_at":"2026-08-02T16:10:09.199211Z","submitted_at":"2025-05-30T07:18:25Z","title":"AReaL: A Large-Scale Asynchronous Reinforcement Learning System for Language Reasoning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24298","snapshot_observed_at":"2026-08-06T22:01:23.648438Z","title":"arXiv:2505.24298 [cs.LG] https://arxiv.org/abs/2505.24298","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.648438Z"},"links":{"cited_paper":"/paper/2505.24298","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:7b64e34084c78a3f3529e53bf9db8ce9da5bcb0c067dbba29607e80e1e16b7bd","observation_id":"91e4a796-2636-4899-b357-0aaf145a915b","resolution":{"observed_at":"2026-08-06T22:01:23.648438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:01:23.668619Z","title":null,"venue":null,"work_id":null,"year":1970},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.668619Z"},"links":{"citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:75afd5de9621d9b9f378a928e367c89dc860d77d1acf390b58adb6d58c1c5fc7","observation_id":"e2a12bd6-bce4-45fc-a22b-36429e1786d8","resolution":{"observed_at":"2026-08-06T22:01:23.668619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:01:24.976280Z","title":null,"venue":null,"work_id":"fcdd4419-1b9f-4dcb-a80d-075b542ea935","year":null},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.657733Z"},"links":{"citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:1336b0cac31b4c23bbf92e3e226b0dfdb329bee1ee1f5b9cd87cfc8e86e748e6","observation_id":"c0a218a9-1eb2-46de-ad02-6bbad8992223","resolution":{"observed_at":"2026-08-06T22:01:24.980796Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-05T13:11:04.104454Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-06T22:01:23.678791Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.678791Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:35fb16f4038134b26dba0e6edadd8c2b1fe39ddcbbd173f970019a9515d05235","observation_id":"3a7bf3c4-4390-4b18-83b9-b8bd7623e577","resolution":{"observed_at":"2026-08-06T22:01:23.678791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:01:24.946978Z","title":null,"venue":null,"work_id":"e8c79e9d-66f9-451c-abe7-4ef85cb7be4e","year":1949},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.683935Z"},"links":{"citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:9aed20e438c3306b49010efa414b58d368341c65bc4f4126b6a8cfbae381c35d","observation_id":"e5c73d4f-ed82-425e-bdd1-a28487e13bd2","resolution":{"observed_at":"2026-08-06T22:01:24.951744Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06180","last_updated":"2023-09-12T12:50:04Z","snapshot_observed_at":"2026-08-02T09:51:08.145755Z","submitted_at":"2023-09-12T12:50:04Z","title":"Efficient Memory Management for Large Language Model Serving with PagedAttention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.06180","snapshot_observed_at":"2026-08-06T22:01:23.672951Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.672951Z"},"links":{"cited_paper":"/paper/2309.06180","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:d05c6680700ca5683b25583b01ca4e1f8548fcf602d1f8e4c7350454b7e3d7be","observation_id":"0324c5d3-8bfb-43a9-b25e-f78c9f0978cd","resolution":{"observed_at":"2026-08-06T22:01:23.672951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-06T22:01:23.696728Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.696728Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:050bdc0e067a873900e4291a22223783f394bbf31b2c8a3262e1bd643cb8c271","observation_id":"83df7646-07b1-49a2-8b27-64def2f8506a","resolution":{"observed_at":"2026-08-06T22:01:23.696728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05102","last_updated":"2022-11-09T18:50:38Z","snapshot_observed_at":"2026-08-06T17:49:15.224623Z","submitted_at":"2022-11-09T18:50:38Z","title":"Efficiently Scaling Transformer Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.05102","snapshot_observed_at":"2026-08-06T22:01:23.701288Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.701288Z"},"links":{"cited_paper":"/paper/2211.05102","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:41489f13ed777e0b8625269bdb8b9f965abfe6f198dedabad2ed357241986e84","observation_id":"556c831d-9d4d-4ebb-a79a-5b862a0c33b8","resolution":{"observed_at":"2026-08-06T22:01:23.701288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:01:23.691994Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.691994Z"},"links":{"citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:6af68a930a61917764053b9abe02ac954f56086d464af418558b1fcf7254926c","observation_id":"1b26baf4-b9f6-4004-89de-59e4080fa7a5","resolution":{"observed_at":"2026-08-06T22:01:23.691994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:01:23.716259Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.716259Z"},"links":{"citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:1fb6dc8aa5e17ea5b0e680da9f8779d56a30b1afbe529e043c894eca6243a29a","observation_id":"075eb96c-3cca-4954-8d59-bee904c6f77b","resolution":{"observed_at":"2026-08-06T22:01:23.716259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-06T22:01:23.722022Z","title":"Manning, and Chelsea Finn","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.722022Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:3dbf6d8e653ceffce464fc4bf73a3a7b29dec96b5a3dac174a99830ef8e71d79","observation_id":"e24bbe5b-553d-4f20-8d0e-ab7256611dc3","resolution":{"observed_at":"2026-08-06T22:01:23.722022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:01:24.914513Z","title":"Kalbarczyk, Tamer Başar, and Ravishankar K","venue":null,"work_id":"e2f968d6-d1df-4bc2-af35-aa02070e6df4","year":null},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.706120Z"},"links":{"citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:0394a836e1cb2425e127a3ff32ec89a19dbc8494d9de9acd427befe619c157e4","observation_id":"e501a27e-f3b9-4dd4-a11f-b5cb318a822c","resolution":{"observed_at":"2026-08-06T22:01:24.923125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08509","last_updated":"2024-11-25T17:35:07Z","snapshot_observed_at":"2026-07-06T17:59:25.200363Z","submitted_at":"2024-04-12T14:46:15Z","title":"Efficient Interactive LLM Serving with Proxy Model-based Sequence Length Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08509","snapshot_observed_at":"2026-08-06T22:01:23.711196Z","title":"arXiv:2404.08509 [cs.DC] https://arxiv.org/abs/2404.08509","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.711196Z"},"links":{"cited_paper":"/paper/2404.08509","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:53ff771e97df3a31ed135a3adc62a4a5ad4d971efb6b4056378e9b4e93d0cb10","observation_id":"7831e371-0d79-4ee5-8c34-0a809bbc6b12","resolution":{"observed_at":"2026-08-06T22:01:23.711196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:01:23.740249Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.740249Z"},"links":{"citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:9218ce977697bce838f166ac804cccd8a535f00e969093427e7c3a11ccd9136a","observation_id":"6342af0b-bbc0-4141-996f-1ae6c8fbad3a","resolution":{"observed_at":"2026-08-06T22:01:23.740249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:01:23.749311Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.749311Z"},"links":{"citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:444f553908b25bd897ad179337eba5d6ef9ca95c7d775b4712feb65ed7fe8d6a","observation_id":"752630ae-3137-4788-a1d3-27aaf5239c58","resolution":{"observed_at":"2026-08-06T22:01:23.749311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.02054","last_updated":"2020-05-13T06:45:15Z","snapshot_observed_at":"2026-07-06T08:27:00.558613Z","submitted_at":"2019-10-04T17:29:39Z","title":"ZeRO: Memory Optimizations Toward Training Trillion Parameter Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.02054","snapshot_observed_at":"2026-08-06T22:01:23.728685Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.728685Z"},"links":{"cited_paper":"/paper/1910.02054","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:cc99d312314fe381e92d19ba49192dc6230028ccb1ab06740f3bb9863a5f9066","observation_id":"526b10c1-46cf-4202-9774-2f0bc85bace8","resolution":{"observed_at":"2026-08-06T22:01:23.728685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.07857","last_updated":"2021-04-16T02:22:12Z","snapshot_observed_at":"2026-07-06T11:00:07.753513Z","submitted_at":"2021-04-16T02:22:12Z","title":"ZeRO-Infinity: Breaking the GPU Memory Wall for Extreme Scale Deep Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.07857","snapshot_observed_at":"2026-08-06T22:01:23.734112Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.734112Z"},"links":{"cited_paper":"/paper/2104.07857","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:810513df82914c78778f2f79863fa0ab551b1a1de83a0aebbf0182fe848e9caa","observation_id":"e2b3638e-38a1-4326-946c-6c6f81a290f7","resolution":{"observed_at":"2026-08-06T22:01:23.734112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18003","last_updated":"2024-11-20T02:04:10Z","snapshot_observed_at":"2026-07-06T18:51:49.871551Z","submitted_at":"2024-07-25T12:56:22Z","title":"Keep the Cost Down: A Review on Methods to Optimize LLM' s KV-Cache Consumption","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.18003","snapshot_observed_at":"2026-08-06T22:01:23.768568Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.768568Z"},"links":{"cited_paper":"/paper/2407.18003","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:08edc62184bb6b2285e08a4a59b44e58a0d029e36b62e088be76d95a23922ce3","observation_id":"461a5b00-b6bf-454a-900d-d65b113bee91","resolution":{"observed_at":"2026-08-06T22:01:23.768568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T22:01:23.773742Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.773742Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:13093bccc94154f9c602d4689d743122d06d750820efe21462257668d31851b4","observation_id":"e8c2a1ec-fe9e-4a25-8d62-26aaef5ee500","resolution":{"observed_at":"2026-08-06T22:01:23.773742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T22:01:23.778031Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.778031Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:89aea144718e0f6cdb802d19325d550336c353d6a2fdffbc1c775e7e00a20fb7","observation_id":"43b9d60f-dec3-466c-932b-8145eee0f448","resolution":{"observed_at":"2026-08-06T22:01:23.778031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23123","last_updated":"2025-03-04T06:22:40Z","snapshot_observed_at":"2026-07-06T19:42:21.306600Z","submitted_at":"2024-10-30T15:31:54Z","title":"On Memorization of Large Language Models in Logical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23123","snapshot_observed_at":"2026-08-06T22:01:23.782702Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.782702Z"},"links":{"cited_paper":"/paper/2410.23123","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:ff1ec6232a63319fe6b0cc6618dfe7430c091e2a73b83e955bb9e2fd3d02e462","observation_id":"5058069b-c939-46af-9846-4f54c05fc867","resolution":{"observed_at":"2026-08-06T22:01:23.782702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-06T22:01:23.760043Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.760043Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:e94f75f098a6a65ace83b9fadf4e71078344617e61a0c9335de5ace418dab320","observation_id":"1ca1adcf-f569-4157-91bf-3b52a2fd4607","resolution":{"observed_at":"2026-08-06T22:01:23.760043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:01:23.764379Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.764379Z"},"links":{"citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:77c32ce85dae5ee1f0887f7d3a533a33ece2cafea85b0ae35efd7a2cb56c2846","observation_id":"f3b65236-2515-4339-9181-4264bc3c47bf","resolution":{"observed_at":"2026-08-06T22:01:23.764379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07104","last_updated":"2024-06-06T00:10:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-12T09:34:27Z","title":"SGLang: Efficient Execution of Structured Language Model Programs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07104","snapshot_observed_at":"2026-08-06T22:01:23.812966Z","title":"Gonzalez, Clark Barrett, and Ying Sheng","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.812966Z"},"links":{"cited_paper":"/paper/2312.07104","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:63b39544080b4caacc01a8473ee1f86c24f93604972501927f5dee77e94ad4aa","observation_id":"fe41b33c-e4ed-4d4c-b436-b80dc72d7493","resolution":{"observed_at":"2026-08-06T22:01:23.812966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:01:23.837341Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.837341Z"},"links":{"citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:0e8fc915fde63cb79eba4271813691b2eb6557fb090543527a177e5a4cbe2032","observation_id":"dfb51034-43cd-4758-80a4-22ac06a00aa4","resolution":{"observed_at":"2026-08-06T22:01:23.837341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15930","last_updated":"2025-04-22T14:19:06Z","snapshot_observed_at":"2026-08-07T16:00:12.969923Z","submitted_at":"2025-04-22T14:19:06Z","title":"StreamRL: Scalable, Heterogeneous, and Elastic RL for LLMs with Disaggregated Stream Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15930","snapshot_observed_at":"2026-08-06T22:01:24.023367Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:24.023367Z"},"links":{"cited_paper":"/paper/2504.15930","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:e32ef9be087508daf14eaa649631e3e7aa666f3954ad4362cd840c49de81eca9","observation_id":"09a90acc-3fd0-4efd-8eda-2e08a99ff9bb","resolution":{"observed_at":"2026-08-06T22:01:24.023367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-06T22:01:23.788123Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.788123Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:7038abc43861ed4ada241dba286b6ebae88d3738aed4d63acd81d92e8907d373","observation_id":"3a569497-5cc8-4f5e-89d9-40f93c10517d","resolution":{"observed_at":"2026-08-06T22:01:23.788123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11998","last_updated":"2024-03-10T19:34:57Z","snapshot_observed_at":"2026-07-06T16:21:45.588487Z","submitted_at":"2023-09-21T12:13:55Z","title":"LMSYS-Chat-1M: A Large-Scale Real-World LLM Conversation Dataset","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11998","snapshot_observed_at":"2026-08-06T22:01:23.797749Z","title":"P Xing, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.797749Z"},"links":{"cited_paper":"/paper/2309.11998","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:2fd2632ce700a10720e952aa73f9bcf69335ce1cd75f4d716f4abae77b1c9b59","observation_id":"0abfcd2f-2d7b-478b-bbc5-bb11e48aa632","resolution":{"observed_at":"2026-08-06T22:01:23.797749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03594","last_updated":"2026-04-22T15:33:51Z","snapshot_observed_at":"2026-07-06T20:01:45.826971Z","submitted_at":"2024-11-29T05:57:37Z","title":"BatchLLM: Optimizing Large Batched LLM Inference with Global Prefix Sharing and Throughput-oriented Token Batching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03594","snapshot_observed_at":"2026-08-06T22:01:23.849216Z","title":"arXiv:2412.03594 [cs.CL] https://arxiv.org/abs/2412.03594","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.849216Z"},"links":{"cited_paper":"/paper/2412.03594","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:9fc247d6513d4f5736648f85e51e69aa791b513d923774ea671907f56caa5150","observation_id":"584b6f7e-317a-418d-96e6-b6d1030f27e3","resolution":{"observed_at":"2026-08-06T22:01:23.849216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T22:01:23.755199Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.755199Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:4dc3820ae10379cb4b8b2ec025be7f11356562e863e8add0fa343942f9ad7b46","observation_id":"f353a0ea-3b89-42f4-bdd7-4bd10b908e8e","resolution":{"observed_at":"2026-08-06T22:01:23.755199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-06T22:01:23.744845Z","title":"arXiv:1506.02438 [cs.LG] https://arxiv.org/abs/1506.02438","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.744845Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:975dfffb2ea71b83a619784a6110226a55477f75e515469ab0ca2484ea12e4ba","observation_id":"5e13f927-1c64-4418-a0bd-da4134782729","resolution":{"observed_at":"2026-08-06T22:01:23.744845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04504","last_updated":"2024-12-03T03:16:12Z","snapshot_observed_at":"2026-07-06T20:02:26.756229Z","submitted_at":"2024-12-03T03:16:12Z","title":"Multi-Bin Batching for Increasing LLM Inference Throughput","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04504","snapshot_observed_at":"2026-08-06T22:01:23.662435Z","title":"arXiv:2412.04504 [cs.CL] https://arxiv.org/abs/2412.04504","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.662435Z"},"links":{"cited_paper":"/paper/2412.04504","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:4c09592a8cd51c76f6b565ed1e5b22f6a5d6692638ae3d7f12afadf1a585406e","observation_id":"0226e5e9-c2e2-4ecc-b316-0636eeba918c","resolution":{"observed_at":"2026-08-06T22:01:23.662435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09142","last_updated":"2025-05-14T04:50:00Z","snapshot_observed_at":"2026-08-07T15:45:32.695385Z","submitted_at":"2025-05-14T04:50:00Z","title":"ELIS: Efficient LLM Iterative Scheduling System with Response Length Predictor","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09142","snapshot_observed_at":"2026-08-06T22:01:23.606728Z","title":"arXiv:2505.09142 [cs.DC] https://arxiv.org/abs/2505.09142","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T22:01:23.606728Z"},"links":{"cited_paper":"/paper/2505.09142","citing_paper":"/paper/2506.22950"},"observation_digest":"sha256:3544f926bc45f626447096e365b5f2a6fa2204b89404071f9843e5435c605bfc","observation_id":"3b90de7b-6217-4c90-9730-19029bdad7de","resolution":{"observed_at":"2026-08-06T22:01:23.606728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.22950","last_updated":"2025-06-28T16:52:29Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T21:52:06.556706Z","submitted_at":"2025-06-28T16:52:29Z","title":"Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2506.22950."}